谷歌团队发布关于线束工程的9页PDF研究(9页)
谷歌团队刚刚发布了一份关于线束工程(harness engineering)的9页PDF。有一个公式改变了你对智能体的认知:智能体 = 模型 + 线束。
有趣的地方是什么?模型都是同一个 Claude Sonnet,基准测试也是同一个,只有线束发生了变化。这套方法总结为6层:
步骤1 → 添加指南:AGENTS.md、规则文件、约束文档。每一个错误都会变成一条永久规则。
步骤2 → 添加传感器:代码检查器、测试、验证器。智能体会在人类看到它的工作之前先自行检查。
步骤3 → 构建循环:规划 → 执行 → 验证 → 修复。添加重试限制、开销上限,以及卡住时的升级处理。
步骤4 → 外化记忆。模型在会话之间会遗忘内容,而线束会保存状态、决策、上下文和产物。
步骤5 → 控制权限。定义它可以访问哪些工具,可以进行多大程度的修改,哪些操作需要批准。安全属于线束,而非模型。
步骤6 → 添加可观测性。追踪工具调用、成本、重试、失败和行为变化,然后在系统开始偏移时触发警报。
结果是什么?你的智能体不再只是一个演示样品,而是开始变成基础设施。每一次失败都会改进系统本身,而不只是改进下一次对话。这就是用来展示的智能体和客户付费让你持续运行的智能体之间的区别。一套线束就能给你可靠的循环。
连接多个智能体,你就会得到图工程:一个智能体的失败会变成另一个智能体的信号。PDF只讲到线束为止,循环是下一层。具体拆解如下 ↓
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖