编码 Agent
主流编码 Agent 产品介绍:Claude Code、Codex、Cursor 等产品的定位、交互形态与工程特点。
这个板块专门介绍已产品化的编码 Agent,而不是开源仓库拆解或框架 API。重点看它们如何组织人机交互、工具调用、上下文、权限和工程工作流。
与相邻板块的区别
| 板块 | 关注点 |
|---|---|
| 编码 Agent | 商业/产品级编码 Agent:Claude Code、Codex、Cursor 等 |
| 开源智能体 | 社区开源项目:OpenHands、aider、SWE-agent 等可读仓库 |
| 案例拆解 | 通用场景分析与源码深读,如 Claude Code 源码解析 |
| 框架工具 | LangGraph、Mastra 等编排框架与 SDK |
收录产品
| 产品 | 一句话定位 |
|---|---|
| Claude Code | Anthropic 终端编码 Agent,强调工具系统、Harness 架构和 MCP 扩展。 |
| Codex | OpenAI 编码 Agent,覆盖 CLI、IDE 扩展和云端异步任务执行。 |
| Cursor | AI 原生 IDE,把 Agent、Composer 和代码库上下文嵌进编辑体验。 |
阅读这些产品时看什么
- 交互入口:终端、IDE、Web 还是云端沙箱。
- 动作空间:读文件、改文件、跑命令、开浏览器、提 PR 的边界。
- 上下文来源:打开文件、代码库索引、规则文件、记忆和外部 MCP。
- 权限模型:自动执行、确认后执行、沙箱隔离各自覆盖什么。
- 适合谁:个人开发者、团队 review、长任务自动化还是日常补全。
使用建议
- 先读产品页建立定位,再对照 Harness 工程构件 看工程边界。
- Claude Code 可继续深读 源码解析案例 和 相关书籍。
- 与 开源智能体 对照阅读,能更好区分「产品体验」和「可 fork 的实现」。
产品形态对比
| 形态 | 代表 | 强项 | 风险 |
|---|---|---|---|
| 终端 Agent | Claude Code、Codex CLI | 贴近 git、shell、测试和本地仓库 | Shell 权限、误操作、输出过长 |
| IDE Agent | Cursor、Codex IDE 扩展 | 上下文来自编辑器、diff 和打开文件 | 容易把自动改动混入手写改动 |
| 云端 Agent | Codex cloud、Open SWE 类产品 | 长任务 offload、异步执行、PR 工作流 | 代码访问、密钥、沙箱和审计 |
| 产品内 Agent | 内部工具、客服后台、业务平台 | 与业务状态和权限深度集成 | 需要自建治理、评测和回放 |
阅读产品页时,不要只看“能不能写代码”,要看它把动作空间、上下文、权限、验证和交付物组织到什么程度。
评估清单
- 它是在本地执行、IDE 执行还是云端执行。
- 它能不能明确展示每一步读了什么、改了什么、跑了什么。
- 它如何处理用户已有未提交改动。
- 它是否支持项目级规则、记忆、MCP 或外部工具。
- 它如何让用户确认高风险命令、文件覆盖、推送和 PR。
- 它的输出能否落到测试、diff、commit、PR 和 review 链路里。
学习顺序
- 先读 Claude Code,理解终端 Agent 和工具权限。
- 再读 Cursor,理解 IDE 内上下文、规则和 diff 体验。
- 再读 Codex,理解 CLI、IDE、云端任务的多入口形态。
- 最后对照 Coding Agent 工程案例,把产品体验拆回通用工作流。
参考来源
- Claude Code documentation:Claude Code 产品和工具能力的官方来源。
- OpenAI Codex documentation:Codex CLI、云端任务和产品入口的官方来源。
- Cursor documentation:Cursor Agent、Rules 和 MCP 能力的官方来源。
- Open SWE repository:异步云端 coding agent 的开源参考。