物种档案 · Species File

Claude Code

把编程会话变成可委派、可并行、可长跑的工程智能体。

自主等级 L4 Anthropic 访问官网 ↗

它是什么

Claude Code 是 Anthropic 推出的编程智能体,最初是终端里的编程助手,随后演进为支持云会话、并行线程与长任务的多智能体编排平台。2026 年 9 月重做的 Projects 把“项目”从一个文件夹变成一场对话:你描述目标,Claude 自行界定范围、委派工作、协调并行线程、审查产出并汇总结果,你离开电脑后它继续工作,也可以用手机随时引导。

智能是怎么发生的

Claude Code 的智能来自一个持续循环的 agentic coding loop:写代码 → 运行 → 观察结果 → 迭代修正。它不是"一次生成",而是像一个真正的程序员一样,在终端里反复调试直到通过。

底层是 Anthropic 的 Claude 系列模型(Sonnet / Opus / Fable),提供推理、代码生成与长上下文理解能力。2026 年最新的 Fable 5.1 模型专为长时间 agentic 任务优化,可持续工作数小时甚至数天。Extended thinking(扩展思考)模式让模型在复杂问题上先深度推理再行动,大幅提升多步骤任务的准确率。

工具集成是核心骨架:文件读写、终端命令执行、Git 操作(diff/commit/push/PR)是原生能力;MCP(Model Context Protocol)允许接入外部服务——Jira、Slack、数据库、LSP 语言服务器等,把 Claude Code 从"编辑器插件"变成"终端里的全栈工程助手"。

2026 年的 Projects 架构是关键进化:一个项目由"协调者"统筹,把工作拆分为多个独立的云会话线程,每个线程在隔离环境中并行执行——迁移代码、跑测试、开 PR——线程之间通过共享记忆协同,互不污染。线程还可以再拆子智能体(subagent),最多嵌套五层。Dynamic workflows(动态工作流)进一步放大这个能力:Claude 自动编写编排脚本,在单次会话中调度数十到数百个并行子智能体,各自独立工作、交叉验证,直到结果收敛。

CLAUDE.md 文件、Rules、Skills、Hooks、Subagents、Plugins 构成七层行为指令体系,让用户能精确控制 Claude 的行为——从"始终遵守的编码规范"到"文件修改后自动格式化"的确定性自动化。

一个真实任务的全过程

假设你对 Claude Code 说:"给这个项目加一个完整的用户认证模块,包括注册、登录、JWT、密码重置,写好测试,开 PR。"

它首先扫描整个代码库——读 package.json 了解技术栈(比如 Next.js + Prisma + PostgreSQL),读现有的路由结构和中间件模式,读 CLAUDE.md 获取团队编码规范。这一步可能读 20-30 个文件,全部进入上下文。

然后它规划:需要新建 auth 相关的路由、中间件、数据库模型、邮件服务、测试文件。它不会一次性写完,而是分步执行——先建数据库 schema 并跑 migration,确认成功后写 API 路由,再写中间件,每完成一步就跑一遍测试验证。

中间会出岔子:比如写密码重置时,它发现项目用的邮件库不支持模板渲染。它不会停下来问你,而是自己搜索替代方案、修改实现、继续推进。如果你开了 Dynamic workflows,它可能同时启动一个子智能体写单元测试、另一个写集成测试、第三个做安全审计——并行工作,最后汇总。

所有测试通过后,它创建一个干净的 Git 分支,写好 conventional commit 信息,推送并开 PR。PR 描述里包含改动摘要、设计决策和测试覆盖说明。

整个过程你可能只在开始时说了一句话,中间在手机上瞥了一眼进度,最后 review PR 时签收。从"一句话"到"一个可合并的 PR",中间的全部决策、试错、验证都是 Claude Code 自主完成的。

公开争议

Claude Code 的争议主要集中在三个层面。

第一是定价与 Token 消耗。Pro 计划 $20/月、Max $100-200/月,但 agentic 模式下 token 消耗远超普通聊天,重度用户频繁触及限额。社区对"标价不透明"和"实际使用成本远高于预期"的抱怨持续存在。Dynamic workflows 的推出进一步加剧了这一争议——官方自己也承认"会消耗显著更多的 token"。

第二是"自主性边界"的讨论。Claude Code 的高度自主是一把双刃剑:它可以在你不知情的情况下修改多个文件、执行终端命令、推送代码。虽然权限系统要求用户确认,但"auto-approve"模式的便利性与安全性之间的张力始终存在。有用户报告 Claude Code 在 auto 模式下执行了超出预期的操作。

第三是与竞品的定位之争。Claude Code vs Cursor vs GitHub Copilot vs Devin——开发者社区对这些工具的最佳使用场景争论激烈。Claude Code 的终端原生定位让它在一部分开发者中极受推崇(2026 年 Pragmatic Engineer 调查中获评"最受喜爱的开发工具"46%),但也让不习惯 CLI 的开发者望而却步。

在物种谱系中的位置

Claude Code 在 AI 编程工具的谱系中,占据"终端原生的全栈工程智能体"这一独特生态位。

• vs Manus:Manus 是"给一句话、交成品"的通用自主 Agent,横跨研究、文档、网页、PPT;Claude Code 专注软件工程,在代码深度上远超 Manus,但场景广度不及。Manus 在云端沙箱里独立执行,Claude Code 在你身边协作。
• vs Devin:Devin 是"领工单的 AI 同事",异步接单、独立交付 PR;Claude Code 更强调实时协作与终端原生体验。Devin 自研 SWE 系列模型,Claude Code 依托 Anthropic 最强模型(Opus/Fable)。Devin 更像"远程同事",Claude Code 更像"身边的资深工程师"。
• vs Cursor:Cursor 是 IDE 内嵌的编码助手,强于前端迭代和视觉预览;Claude Code 是终端原生,强于后端重构、基础设施和长时间自主任务。两者常被组合使用——Cursor 做日常编辑,Claude Code 做重活。
• vs GitHub Copilot:Copilot 是 IDE 内的补全与对话助手,自动化程度低于 Claude Code。Copilot 胜在生态集成(VS Code 原生),Claude Code 胜在自主性和任务复杂度。

一句话定位:坐在你旁边的资深工程师——你说目标,它规划、编码、测试、调试、开 PR,但你随时可以接管方向盘。

能自主完成什么

  • 连接多个代码仓库,按目标在每个仓库开线程迁移、测试、开 PR
  • 并行分析性能瓶颈、试验优化并汇总哪些 PR 该先合并
  • 线程在独立分支与仓库副本上工作,冲突以常规合并冲突方式处理
  • 从 CI 失败自动修复,跨会话共享项目记忆
  • 处理文档、合同等非代码长任务,手机端可随时接管

关键能力

  • 云会话:每个线程是独立的 Claude Code 云会话,离线后继续运行
  • 共享记忆:线程从共同记忆中读写项目细节与用户风格
  • 协调者 + 工作线程两级架构,线程可再用子智能体/循环/工作流拆分
  • 支持连接器、插件、沙箱云端环境与多档推理强度

自主等级评级:L4

Claude Code 可接受工程目标后自行规划、改代码、跑测试、开 PR,满足 L2;2026 年重做的 Projects 提供跨线程共享记忆,能记住项目决策与沟通风格,满足 L3;一个项目由协调者把工作分派给多个并行云会话线程,线程还可再拆子智能体,典型的多体协作,达到 L4。其能从 CI 失败中自我修复,但自我改进仍限于任务层面,不足以称 L5。

成长时间线

  • 2025-02-24 随 Claude 3.7 Sonnet 一同发布 Claude Code 研究预览版。
  • 2025-05-22 Claude Code 随 Claude 4 正式 GA,支持 GitHub Actions 后台任务及 VS Code、JetBrains 集成。
  • 2025-09-11 发布 Sonnet 4.5,被定位为面向真实智能体与计算机操作的领先模型,并引入记忆能力。
  • 2025-11-24 发布 Opus 4.5,视觉、编码与计算机操作能力大幅提升。
  • 2026-02-20 Sonnet 4.6 发布,Claude Code 平台整体 GA,网页搜索、代码执行等能力转正。
  • 2026-09-17 重做的 Projects 进入 Beta:一场对话自动拆分为并行云会话线程,共享记忆、离线长跑。
← 返回物种档案列表