
编程语言Agent RuntimeToken BudgetContext EngineeringEval成本治理
《Agent Runtime 工程化》一次 Agent 任务为什么能烧掉几十次 LLM 调用?
一次 Agent 任务为什么能烧掉几十次 LLM 调用? 很多团队第一次算 Agent 成本,会算错。 他们按一次聊天请求算: 这个算法适合普通 Chatbot,不适合 Agent。 Agent 的成本通常长这样: 每一步都可能重新构造上下
陈堂会49 浏览0 点赞约 18 分钟阅读

一次 Agent 任务为什么能烧掉几十次 LLM 调用? 很多团队第一次算 Agent 成本,会算错。 他们按一次聊天请求算: 这个算法适合普通 Chatbot,不适合 Agent。 Agent 的成本通常长这样: 每一步都可能重新构造上下

Agent 为什么必须有 Token Budget? 上一篇我们给 Agent Loop 加了 maxSteps。 很多人做到这里,会松一口气:至少 Agent 不会无限跑了。 但只靠 maxSteps,控不住成本,也控不住上下文质量。 原