跳转到内容

Agent 工程教程路线:用 Harness 把不稳定的 Agent 变成可审计系统

Agent 做错事时,原因通常不只是模型不够聪明。规则是否被读到、工具是否可用、权限是否越界、状态是否丢失、反馈是否能进入下一轮,都会决定结果。

你现在遇到的事先读第一个可验收结果
Agent 能做事但总做不稳Harness 的五个组件一份按组件定位的系统检查
Agent 不断遗漏项目规则指令层一份可读取、可审计的指令面
Agent 反复遗忘已验证的状态记忆层一份能跨轮次继续使用的状态记录
  1. 先区分任务失败来自模型推理,还是来自指令、工具、权限、状态或验收合同缺失。
  2. 约束层 写清绝对不能跨越的动作,并让高风险步骤进入明确的确认门。
  3. 再用 反馈层 把测试、审查和真实环境信号接回下一轮,而不是只收集一条“完成了”。
  • 一张当前 Agent 系统的指令、能力、约束、状态和编排地图。
  • 一项可以通过命令、fixture 或人工检查验证的失败假设。
  • 一条发现异常后能停止、记录并进入下一轮的反馈路径。

当你需要把多个角色和长任务连接起来,继续读 编排层。如果问题只是第一次用 Agent 写代码,先回到 AI 编程实践路线