Claude Code 爆发:终端里生长的自主编程 Agent

九个月增长六倍,SWE-bench 87.6% 登顶,Claude Code 为何成为高端开发者的首选。
2026 年,AI 编程工具的竞争焦点已经从「谁的补全更准」变成了「谁的 Agent 更能自己干活」。其中增长最猛的,是 Anthropic 的 Claude Code:从 2025 年 5 月正式发布到 2026 年初,九个月里使用量增长了约六倍,在一项开发者调研中与 Cursor 并列成为使用率第二高的工具。
它和普通 AI 助手有什么不同
大多数 AI 编程工具是「编辑器里的一个侧边栏聊天框」,而 Claude Code 从一开始就是活在终端里的自主智能体:你把它指向一个代码仓库,用自然语言描述任务,它会读遍相关文件、制定计划、就地改文件、运行命令,并和 GitHub Actions、VS Code、JetBrains 等集成,最后把改动以差异(diff)的形式交给你审查。
图1:Agent 不是一次问答,而是一个会自己迭代的闭环
为什么强:上下文与评测
Claude Code 背后是 Claude Opus 系列模型,其百万级 token 上下文窗口能装下整个中型代码库,而不用东拼西凑地「摘要」。在 SWE-bench Verified 这类需要跨多文件修改、自动生成测试的真实任务基准上,Claude Code 拿到了约 87.6% 的成绩,是当时已发布工具里最高的。
代价与边界
能力越强,账单越贵:自主工作消耗的 token 是普通补全的几十倍,重度使用一个月的 API 费用可达上千美元。此外它要求你熟悉终端、没有图形界面。因此它的最佳定位是「其他工具搞不定时才请出场的资深帮手」——日常小改动用补全式工具,架构级难题交给它。
关联推荐
- 118B 碾压万亿模型:编程 Agent 效率新王 — 看另一款编程 Agent 的基准表现
- 2026 Agent 编程巨变:从「人写代码」到「人指挥 AI Agent 写」 — 理解范式整体迁移
- Meta Astryx:能写代码并提交 PR 的 AI 程序员 — 同类 Agent 的不同路线
评论 (0)
加载评论中…