Agent Runtime Engineering v0.1 发布
今天把这个项目正式按 v0.1 的方式放出来。
仓库地址:
https://github.com/zeeklog/agent-runtime-engineering
先说清楚:v0.1 不是完整框架。
也不是'开箱即用的生产级 Agent'。
它更像一个工程入口:
Agent Loop → Harness → Runtime → Sandbox → Production
先把主线、术语、目录、清单和示例计划立住。
为什么先发 v0.1
很多项目会等到所有东西都写完再发布。
我这次反过来。
先发布一条可检查的路线。
原因很简单:Agent Runtime 这件事太容易写散。
今天写 tool calling。
明天写 MCP。
后天写 LangGraph。
再过几天写 memory。
最后每篇都对,但合起来没有主线。
我希望 v0.1 先回答:
这本书和这个项目到底训练什么能力?
一个 Agent 从 demo 进生产要跨过哪些层?
哪些模块应该被拆成示例代码?
上线前有哪些 checklist?
读者怎样参与早期反馈?
所以 v0.1 的重点不是炫功能。
是定边界。
v0.1 包含什么
计划中的 v0.1 结构是:
agent-runtime-engineering/
├── README.md
├── book/
│ ├── table-of-contents.md
│ ├── preface.md
│ └── sample-chapter/
├── architecture/
│ ├── agent-runtime.md
│ ├── agent-loop.md
│ ├── harness.md
│ ├── sandbox.md
│ └── observability.md
├── examples/
│ ├── 01-basic-agent-loop/
│ ├── 02-runtime/
│ ├── 03-tool-runtime/
│ ├── 04-permission/
│ ├── 05-context-builder/
│ ├── 06-checkpoint-resume/
│ └── 07-eval-harness/
├── checklist/
│ ├── production-agent-checklist.md
│ └── production-agent-release-gate.md
└── docs/
当前仓库会先从 README、目录、checklist 和样例章节开始。
examples 会按运行链路拆成最小可验证示例。
我不想假装它今天已经是成熟框架。
现在它是 v0.1。
v0.1 就该诚实。
这个项目不做什么
先排除几个误会。
它暂时不做:
通用 Agent SaaS
另一个 LangChain
另一个 LangGraph
万能 MCP 客户端
可直接商用的安全沙箱
模型评测排行榜
它要做的是:
把 Agent Runtime 的工程责任讲清楚。
用 TypeScript/Node 写一套可读、可改、可测的最小示例。
让读者知道生产级 Agent 哪里会出事。
让每个模块都能对应 trace、eval 和 checklist。
这是一本书的配套工程项目。
不是一个野心过大的基础设施平台。
v0.1 的核心资产
第一,术语边界。
Agent
Workflow
Tool
Runtime
Harness
Sandbox
Trace
Checkpoint
Eval
这些词如果不先说清,后面讨论会一直绕。
第二,Production Agent Checklist。
前面的文章已经整理了模块级 checklist。
后面的 release gate 文章会展开成 50 项检查。
这两份清单会进入仓库。
第三,试读章节。
试读部分会先讲 Agent Loop 生命周期。
下一篇试读会讲 Tool Runtime 与权限审批。
这两篇会作为 sample chapter 的基础。
第四,示例代码路线。
不是一口气写一个大框架。
而是按模块推进:
basic loop
runtime state
tool registry
permission
context builder
checkpoint
trace
eval
每个示例都要能单独跑,能被测试,能被文章解释。
为什么用 TypeScript / Node
不是因为 TypeScript 最高级。
而是因为 Agent Runtime 很容易碰到这些 Node 能力:
AbortSignal
async iterator
stream
child_process
filesystem
package manager
CLI
MCP server
frontend / backend integration
coding agent 要读文件、跑测试、改代码、处理终端输出,就绕不开这些东西。
TypeScript 也适合表达 runtime contract。
工具 schema、ToolResult、RunState、PermissionDecision、TraceEvent,都需要清晰类型。
v0.1 的读者
我希望早期读者不是来找'现成魔法'的。
更适合这些人:
写过 Agent demo,但准备把它接进真实项目的人
在二开 coding agent、IDE agent 或内部 Agent 平台的人
想从 prompt 使用者转向 runtime 工程师的人
负责审查 Agent 上线风险的技术负责人
如果你只是想复制一段代码立刻做产品,这个仓库早期可能不适合。
如果你想搞清楚 Agent 为什么会失控、为什么难恢复、为什么工具治理复杂,它会越来越有用。
v0.2 会补什么
v0.2 的优先级我会放在:
examples/01-basic-agent-loop
examples/02-runtime
examples/03-tool-runtime
checklist/production-agent-checklist.md
architecture/agent-runtime.md
也就是先把'能跑的最小 Runtime 骨架'和'工具治理清单'补齐。
v0.3 再补:
permission
sandbox profile
checkpoint/resume
trace writer
eval harness
每个版本都要小。
每个版本都要能解释清楚它解决了什么。
参与方式
现在最需要的不是 star。
当然 star 也欢迎。
更需要的是反馈:
哪些概念讲得不清楚?
哪些 checklist 不适合真实生产?
哪些示例最应该优先写?
你在做 Agent 时踩过什么坑?
有没有真实 trace / 事故可以匿名改写成案例?
这类反馈比泛泛一句'不错'更有价值。
因为这本书和这个项目的目标,本来就是贴近真实工程。
最后
Agent Runtime Engineering v0.1 的价值,不在于它现在已经多完整,而在于它把一条工程路线先固定下来。
从能运行的 Agent,到生产级 Agent Runtime,中间缺的不是更多概念,而是能被检查、复盘和迭代的工程资产。
接下来会继续招募 Early Reader,并把反馈压回书稿、示例和清单里。


