
书名:《Agent Runtime 工程化:从工具调用循环到可恢复执行系统》
作者:陈堂会
章节:第九章 可观测与 Trace / 9.3 失败归因
电子版系列:查看完整目录
第九章 可观测与 Trace:9.3 失败归因
Agent 失败常被粗暴归结为'模型不行'。这不专业。至少分成五类:
| 归因 | 典型现象 |
|---|---|
| 模型问题 | 推理错误、忽视观察结果、重复无效计划 |
| 工具问题 | 工具崩溃、返回格式错、输出不完整 |
| 权限问题 | 策略过严或过松,审批状态丢失 |
| 上下文问题 | 关键文件未注入,历史摘要误导 |
| Runtime 问题 | 停止条件、重试、并发、恢复逻辑错误 |
trace 的价值,就是把'感觉'拆成证据。比如模型误改文件,可能并非模型能力不足,而是 context builder 没有放入测试约束;工具重复执行,原因也许不是模型执拗,而是 runtime 没有重复调用检测。
系列导航
前 5 篇
- 第九章 可观测与 Trace:9.2 必须记录的字段
- 第九章 可观测与 Trace:9.1 Agent trace 的基本结构
- 第九章 可观测与 Trace:导读
- 第八章 Checkpoint、Resume、Rollback:8.8 验收标准
- 第八章 Checkpoint、Resume、Rollback:8.7 动手任务

