Damn AgentBeta

开源智能体

社区开源智能体具体项目的工程拆解入口。

这个板块专门讲社区中的具体开源智能体项目。它和「框架工具」不同:框架页关注 API、抽象和选型;开源智能体页关注一个具体项目如何组织目标、工具、记忆、运行环境、交互界面、部署方式和贡献生态。

为什么单独成板块

  • 开源智能体项目比框架更接近可运行产品,能看到真实目录结构、工具封装、UI、任务状态和部署方式。
  • 同一个项目往往同时包含 prompt、工具、浏览器、终端、记忆、队列、权限和前端交互,不适合只放进框架页。
  • 读者需要知道哪些设计能借鉴,哪些只是 demo,哪些已经适合二次开发。

收录项目

代码智能体

项目为什么先看
OpenHands开源软件工程 Agent 平台,覆盖代码编辑、终端、浏览器、sandbox 和软件开发任务。
SWE-agent围绕真实 GitHub issue 修复和 SWE-bench 建立了清晰的研究与评测样本。
aider终端内 pair programming,适合观察 repo map、git 工作流和多文件编辑体验。
Open SWE异步云端 coding agent,重点看 GitHub issue、计划、测试、PR 和人类审核链路。
Plandex面向大项目和多步骤改动,适合观察计划、上下文和长任务代码修改。

研究智能体

项目为什么先看
GPT Researcher开源 deep research agent,重点看多来源检索、引用和报告生成。

浏览器与计算机使用智能体

项目为什么先看
Browser Use让 Agent 控制真实浏览器,适合拆解 browser harness、恢复循环和网页任务。
Open Interpreter让 LLM 在本地运行代码和操作计算机,适合拆解 harness、Shell 和 computer use。

通用任务智能体

项目为什么先看
OpenClaw把个人助理、消息渠道、Gateway、Canvas、技能、sandbox 和安全暴露放在一个可运行项目里。
Hermes Agent把 CLI/TUI、消息网关、技能记忆、自改进循环、cron 和多运行后端组合成完整 Agent 产品。

拆解时看什么

每个项目页都应能回答:

  1. 它解决什么任务,运行入口在哪里。
  2. 工具、记忆、状态和权限分别落在哪些模块。
  3. 哪些设计值得借鉴,哪些只是 demo 或研究原型。
  4. 最小可运行路径和当前维护状态。

统一拆解模板

阅读每个开源智能体时,建议用同一张表做笔记:

维度要记录什么
任务入口CLI、Web UI、GitHub issue、浏览器任务、消息渠道、API。
Agent Loop观察、计划、行动、反思、停止条件分别在哪里实现。
工具系统文件、Shell、浏览器、搜索、API、数据库、消息平台如何暴露。
状态与记忆会话、项目上下文、长期记忆、任务轨迹、缓存如何保存。
执行环境本地、Docker、远程容器、云浏览器、沙箱、终端后端。
人类介入计划确认、工具审批、diff review、PR review、错误接管。
可观测性trace、日志、成本、测试、评测样例和失败回放。
安全边界密钥、文件系统、网络、账号、外部副作用、敏感数据。

这个模板能帮助你区分“项目真的解决了工程问题”,还是只是把模型调用包装成了一个漂亮入口。

横向比较

项目类型首要学习点典型风险
Coding Agent仓库理解、diff、测试、PR、CI、review自动改代码越权、测试不足、上下文污染
Research Agent检索、证据、引用、报告结构来源过期、引用虚假、结论过度概括
Browser / Computer Use页面观察、动作空间、恢复循环账号风险、误提交、网页变化、隐私泄露
个人助理 / 通用 Agent长期记忆、多渠道、技能、调度外部输入越权、长期记忆污染、密钥暴露

使用边界

开源项目适合学习架构和验证想法,但不要把它们的默认权限、默认 prompt 或默认部署方式直接搬进生产系统。二次开发前至少要做三件事:

  • 在隔离环境跑通最小任务,而不是直接连真实账号和生产仓库。
  • 阅读许可证、第三方依赖、数据收集、遥测和安全说明。
  • 为每个外部副作用动作补充审批、审计和回滚路径。

与相邻板块的关系

  • 框架工具:看抽象、API 和选型,不看具体产品形态。
  • 编码 Agent:看 Claude Code、Codex、Cursor 等商业/产品级编码 Agent。
  • 案例拆解:保留更通用的场景分析和源码深读。
  • 工程实践:把从开源项目里学到的模式沉淀为可复用做法。

参考来源

On this page