VOL.01 · WINTER 2026 · ISSUE 001
构建可靠的 Agent Harness
从真实项目出发,以契约、证据与反馈,构建可持续的 Agent 工程交付。
共 24 节 · 5 阶段。五阶段是主要矛盾的五次转移;从序篇那根线开始, 也可以直接翻到你此刻卡住的那一叠。
Section 00 · PROLOGUE
序篇
为什么要造 Harness,它又如何运转
回看模型能力为何不足以独立完成工程交付;以主要矛盾的转移为主线,读懂一个 change 的运行、分层、信息流与迁移边界,建立后续学习的判断坐标。
Section 01 · PHASE ONE
阶段一
把意图变成Agent可执行的契约
从 Plan 的问题澄清与方案权衡开始,把意图、验收条件和真源顺序写成可复查的契约;让人与 Agent 对做什么、如何验证及依据何在形成共同基座。
Section 02 · PHASE TWO
阶段二
让 Agent 在正确条件下动手
围绕上下文的质量、时机、位置与边界,建立职责分层、工具与记忆机制,按角色选择模型,并用隔离环境和进场检查支撑执行;让 Agent 在正确材料和受控环境中工作。

先认识上下文,再动手
把“agent 怎么又变蠢了”从抱怨变成一句有具体指向的诊断

上下文怎么管
When / Where / How:先收拾书桌,再给 Agent 分派任务

把 Agent 排成一支队伍
谁调度、谁决策、谁干活——分好层、定好编制、立好规矩

Agent平台与任务底座模型怎么选
平台选可编程的内核,模型按角色分三档——一次算清,以后不用再想

Agent的手与脑
工具是手,记忆是脑。工具的矛盾是规模,记忆的矛盾是时效。

给 agent 建三段阵地:开发隔离、进场体检、交付防护
开发用 git worktree 隔离工作区,进场用 doctor 体检,运行时用 Docker 预览控制爆炸半径
Section 03 · PHASE THREE
阶段三
把 Agent 的交付交给独立事实
第二次飞跃 · 全课的转折点
将 Agent 的自我完成声明交由独立事实校核;从失败的实践中构建出确定性门禁,明确机器、评审与人的责任边界,并让测试服务于真实风险和可追溯证据。
Section 04 · PHASE FOUR
阶段四
让改动在 Agentic Loop 证据中持续演进
以可重入的任务循环组织开发、评审与收口,以制品而非长会话传递契约和证据;通过评审判据、仲裁、容错与分层责任,使改动在受控反馈中持续演进,并保留人的最终决策权。
Section 05 · PHASE FIVE
阶段五
让 Harness 经得起生产与演进
将验证延伸到生产环境的真实后果,以发布回退、回归案例和测试数据治理建立长期反馈;再治理工具、契约与文档的漂移,把课程方法作为相对真理带回自己的项目重新诊断。


















