Damn AgentBeta
资源清单

《Claude Code Harness Engineering》

梳理 Harness 三组件、Managed Agents、Session、Sandbox、上下文压缩、记忆、多 Agent 与生产化。

《Claude Code Harness Engineering:从入门到实战》是本站工程实践层的主要参考书。它回答的不是「Agent 有哪些模式」,而是「一个会调用真实工具的长任务 Agent,如何拆成可恢复、可审计、可扩展的工程系统」。

属性内容
页数163
下载PDF
主要对应页面Harness 工程构件智能体基础

这本书解决什么

  • 解释为什么要把 LLM 调用、工具执行和状态管理拆开。
  • 给出 Session、Harness、Sandbox 三个核心构件的职责边界。
  • 说明长任务中的检查点、Sprint Contract 和崩溃恢复。
  • 覆盖上下文压缩、记忆、多 Agent、权限和生产化部署。

推荐章节与主题

主题在站内的用途参考页码
Agent 定义与 ReActLLM 局限、思考-行动-观察循环pp. 8-11
Sandbox 与安全隔离执行、凭证外置、资源限额pp. 43-50
Session 事件日志append-only、可回放、可审计pp. 51-56;pp. 80-87
Harness 无状态编排解耦大脑与双手、水平扩展pp. 79-87
上下文与压缩Token 预算、压缩与缓存策略pp. 88-95
记忆跨会话状态与项目经验pp. 96-106
多 AgentCoordinator/Worker、冲突与恢复pp. 107-116
MCP 与生产化工具标准化、上线检查pp. 152-156

阅读顺序建议

  1. 先读 Agent 定义和 ReAct,弄清 Harness 要补的缺口。
  2. 再读 Session、Harness、Sandbox,建立三组件心智模型。
  3. 然后读上下文、记忆和多 Agent,处理长任务问题。
  4. 最后结合 《Demystifying Claude Code v1.8》 看真实产品如何落地。

站内已引用内容

使用注意

  • 本书以 Claude Code 场景为例,但构件划分可迁移到其他 Agent 产品。
  • 阅读时关注「谁保存状态、谁执行副作用、谁可替换」,不要只记名词。
  • 与模式书对照阅读效果更好:模式书讲 what,本书讲 how to engineer。

三组件心智模型

组件负责不负责
Session事件日志、状态、检查点、恢复、审计直接执行外部副作用
Harness编排模型调用、工具路由、上下文装配、重试长期保存所有业务事实
Sandbox隔离执行、资源限制、命令和文件系统边界决定业务目标是否完成

这三者分开后,Agent 才能恢复、回放和水平扩展。很多 demo 失败不是模型不够强,而是状态、编排和执行混在一起。

站内复用方式

阅读检查题

读完后至少能回答:

  • 为什么 append-only session log 比只保存最终状态更适合 Agent。
  • 为什么工具执行要放进 sandbox,而不是让模型直接调用系统资源。
  • 上下文压缩应该保留哪些任务状态。
  • 多 Agent 里的 Coordinator 和 Worker 如何避免冲突。
  • 生产化 Agent 为什么需要监控、权限、恢复和人工接管。

参考来源与引用清单

可复核出处:《Claude Code Harness Engineering:从入门到实战》PDF

  • Agent 定义与 ReAct:pp. 8-11。
  • Sandbox 与安全:pp. 43-50。
  • Session 事件日志:pp. 51-56;pp. 80-87。
  • Harness 无状态编排:pp. 79-87。
  • 上下文与压缩:pp. 88-95。
  • 记忆:pp. 96-106。
  • 多 Agent:pp. 107-116。
  • MCP 与生产化:pp. 152-156。

On this page