Agent Runtime Engineering v0.1 发布
今天把这个项目正式按 v0.1 的方式放出来。
仓库地址:
https://github.com/zeeklog/agent-runtime-engineering
先说清楚:v0.1 不是完整框架。
也不是'开箱即用的生产级 Agent'。
它更像一个工程入口:
Agent Loop → Harness → Runtime → Sandbox → Production
先把主线、术语、目录、清单和示例计划立住。
为什么先发 v0.1
很多项目会等到所有东西都写完再发布。
我这次反过来。
先发布一条可检查的路线。
原因很简单:Agent Runtime 这件事太容易写散。
今天写 tool calling。
明天写 MCP。
后天写 LangGraph。
再过几天写 memory。
最后每篇都对,但合起来没有主线。
我希望 v0.1 先回答:
这本书和这个项目到底训练什么能力?
一个 Agent 从 demo 进生产要跨过哪些层?
哪些模块应该被拆成示例代码?
上线前有哪些 checklist?
读者怎样参与早期反馈?
所以 v0.1 的重点不是炫功能。
是定边界。
v0.1 包含什么
计划中的 v0.1 结构是:
agent-runtime-engineering/
├── README.md
├── book/
│ ├── table-of-contents.md
│ ├── preface.md
│ └── sample-chapter/
├── architecture/
│ ├── agent-runtime.md
│ ├── agent-loop.md
│ ├── harness.md
│ ├── sandbox.md
│ └── observability.md
├── examples/
│ ├── 01-basic-agent-loop/
│ ├── 02-runtime/
│ ├── 03-tool-runtime/
│ ├── 04-permission/
│ ├── 05-context-builder/
│ ├── 06-checkpoint-resume/
│ └── 07-eval-harness/
├── checklist/
│ ├── production-agent-checklist.md
│ └── production-agent-release-gate.md
└── docs/
当前仓库会先从 README、目录、checklist 和样例章节开始。
examples 会按运行链路拆成最小可验证示例。
我不想假装它今天已经是成熟框架。
现在它是 v0.1。
v0.1 就该诚实。
这个项目不做什么
先排除几个误会。
它暂时不做:
通用 Agent SaaS
另一个 LangChain
另一个 LangGraph
万能 MCP 客户端
可直接商用的安全沙箱
模型评测排行榜
它要做的是:
把 Agent Runtime 的工程责任讲清楚。
用 TypeScript/Node 写一套可读、可改、可测的最小示例。
让读者知道生产级 Agent 哪里会出事。
让每个模块都能对应 trace、eval 和 checklist。
这是一本书的配套工程项目。
不是一个野心过大的基础设施平台。
v0.1 的核心资产
第一,术语边界。
Agent
Workflow
Tool
Runtime
Harness
Sandbox
Trace
Checkpoint
Eval
这些词如果不先说清,后面讨论会一直绕。
第二,Production Agent Checklist。

