第 33 章:Building on the Harness — Kocoro
从 Harness 视角理解运行时、工具、状态和用户交互如何共同支撑 Agent。
本章要解决什么
一个可靠的 Agent 上限,为什么不只由模型决定?
本章不把某个框架的 API 当作结论,而是先明确任务边界、运行状态和验收证据,再决定实现方式。这样同一套方法才能迁移到 Codex、WorkBuddy 或其他 Agent 运行环境。
核心概念
- 目标与边界:明确 Agent 要完成的结果、允许的操作和不能触碰的范围。
- 状态与证据:记录当前进度、工具返回值和人工验收依据,避免只凭最终文字判断成功。
- 反馈与停止:为每一步设置可观察反馈,并定义成功、失败、重试和停止条件。
建议练习
为现有 Agent 做一次 Harness 审计,记录运行时、工具、状态和验证的缺口。
建议把练习记录成一张任务卡:
| 项目 | 内容 |
|---|---|
| 任务目标 | 写出可验收的结果,而不是泛泛地“帮我处理” |
| 可用上下文 | 列出规则、资料、历史状态和限制 |
| 可用动作 | 只开放完成任务必需的工具 |
| 验收证据 | 指定谁在什么位置检查什么结果 |
| 失败回退 | 规定无法继续时如何停下并交接 |
与本 Part 的关系
本章属于 Part 9 / 前沿 Agent 能力。读完后,回到本 Part 概述页整理自己的知识卡,再进入下一章。