跳到主内容
TOOL · CODING #11/13AI CLI
Claude Code

Claude Code

Anthropic 官方终端 AI Coding Agent,长任务能力业界第一梯队

cliagentterminalanthropiclong-taskmcp
访问官网 GitHub 关注此工具更新
能力
5
易用
4
性价比
3
中文
2
稳定
4

编辑结论

评分方法 综合3.6/ 5

Cursor 的强力补充。终端原生、IDE 无关、长任务跑得比 Cursor 稳。但 API 计费贵且国内更难用。

发布 2026-06-18更新 2026-09-20核实 2026-09-20
01 / 07深度解读

TL;DR

一句话: Anthropic 官方 CLI Agent,终端原生,长任务执行能力是目前体感最稳的一档。装好后在任何项目根目录跑 claude,用自然语言让它读代码、改文件、跑测试、提交 commit——全自动。

最大价值是 不绑死 IDE——VS Code、JetBrains、Vim、Emacs、Neovim 全能用,远程 SSH 也行。代价是 国内三大门槛:账号要海外手机、支付要海外卡、网络要稳定代理。

2026-08-30 限额公告:Anthropic 官宣 9 月 14 日起标准周限额永久 +25%(Pro / Max / Team / 按席位 Enterprise),但 5 月 13 日起的临时 +50% 促销同日到期——1.5x 回落到 1.25x,相对当前实际可用量到手反而少约 17%。需要跑大任务的尽量赶在 9-13 之前,详见限额调整资讯

2026-08 最新进展(v2.1.232):核心模型已升级为 Claude Sonnet 5(复杂任务用 Opus 4.8),1M 上下文;新增 /fork(复制会话到后台并行)、/subtask(取代内联子 agent)。v2.1.232(8-14) 重点增强多 Agent 与安全性:子 Agent 分支(subagent forking)默认开启,子 Agent 继承完整对话与 prompt cache;新增 @-mention 语法可在会话间直接发消息(SendMessage,无需确认);支持 GitLab marketplace;并修复了一批权限绕过与凭证处理的安全漏洞,增强 Remote Control 稳定性。Claude Code for Visual Studio(7-08)成为首个正式接入调试器(断点/运行时变量/调用栈)的 AI 编程工具。会话级上限(WebSearch 200 次、子 agent 200 个);MCP 调用超 2 分钟自动转后台。Claude Code 约占 AI 编程赛道一半市场,ARR 约 $2.5B。

2026-09 更新(v2.1.269,9-11)claude plugin eval 跑插件评测套件并返回可复现的评分;/output-style [name] 即时切换输出风格;Bash 工具结果现在附带改动文件的 diff;OpenTelemetry 指标增加仓库维度标签。此前 v2.1.268(9-10)已加入 Claude Apps 网关的 gateway.yaml 定价控制,并为 WebFetch 加上 300 秒超时。同版本的安全侧还需注意两点:修复了两处 deny 规则绕过(针对 /tmp/var 等符号链接路径的 deny 规则此前可能不生效,升级后请重新验证),以及 /mcpclaude mcp list 不再打印从 ${VAR} 解析出的真实密钥;官方建议升到 2.1.268+,用 ANTHROPIC_BASE_URL 接第三方端点的不要停留在 2.1.265–2.1.267。详见 AI 编程周报 2026-09-122026-09-13

2026-09 补记(claude plugin eval 细节,v2.1.269):这套命令最关键的设计是双臂对比——每条用例默认跑 3 次带插件 + 3 次不带插件,输出 WITH / W/OUT / Δ,而 Δ 才是插件的真实贡献:若两臂都接近满分、Δ ≈ 0,说明这个 skill 是冗余的。官方点出的最常见首测结果正是 Δ 接近 0 且 tool_used: Skill 判定失败——意思是「用自然说法提问时,Claude 根本没选中你的技能」,而这恰恰是 claude plugin validate 查不出来的行为层问题(后者只校验 manifest 语法与 schema)。grader 共 6 种:regex / tool_used / tool_order / file_exists 四种从会话记录与文件直接判定(不花钱),llm / baseline 两种调用裁判模型(计费)。CI 场景可用 --threshold 0.8 --max-cost-usd 20 --trust-plugin --no-publish,且务必同时固定 --model--judge-model,否则上游静默升级会让分数漂移、被误读成插件回归。同版本还把单次运行的并发 Agent 上限通过 CLAUDE_CODE_WORKFLOW_MAX_CONCURRENT_AGENTS 从 1 提到 256。有内部 skill / 插件的团队,这是本周最值得接进 CI 的一个能力。详见 AI 编程周报 2026-09-17

2026-09 更新(v2.1.275 / v2.1.276,9-17 ~ 9-18)v2.1.275 带来网关登录确认(网关指名已登录账号时先确认再保存凭证,/status 会显示)、send-now 快捷键ctrl+enterctrl+x ctrl+s 打断当前轮并一次性发送全部排队消息)、OpenTelemetry 启动告警(otelHeadersHelper 配置失败时立即告警而非静默不导出)、claude.ai 的 skill 与 plugin 同步到终端会话(可用 syncClaudeAiSkills: false / syncClaudeAiPlugins: false 关闭),以及 /plugin install --marketplace 会询问是否自动添加 marketplace。但它引入了一个代理回归:凡是 ANTHROPIC_BASE_URL 指向代理或 LLM 网关的请求全部以 400 错误失败v2.1.276 于次日当天热修——用自建网关 / 中转的团队必须立即升到 2.1.276+,且建议升级前先在灰度环境验证网关配置。详见 AI 编程周报 2026-09-19

2026-09-20 更新(v2.1.277,9-18 + Projects 重构,9-17 起 beta):两件事,一件是「小修补上了两年前的坑」,一件是「产品形态变了」。

AGENTS.md 回退读取(v2.1.277):项目根没有 CLAUDE.md 时,Claude Code 现在会直接读根目录 AGENTS.md 作为项目指令,可在 /config → Project instructions 关闭;Bedrock / Vertex / Foundry 暂不支持。这是它坚持只用自家 CLAUDE.md 两年后的第一次让步,对已经在用 AGENTS.md 的团队是实打实少维护一份文件——但注意它是回退而不是合并:只要仓库里存在 CLAUDE.md(哪怕是空文件),AGENTS.md 就不会被读。想两份都生效,目前仍以 CLAUDE.md 首行写 @AGENTS.md 或做 symlink 最稳。

Projects 从「文件夹」重构为「协调器」:官方 9-17 起 beta —— 你给一个目标 + 仓库,coordinator 负责拆任务、派活、跟踪与汇总每个 thread 是一个完整的 Claude Code 云端 session,跑在自己的分支与仓库副本上,自动开 PR、跑测试;两个 thread 动了同一处代码时,按普通 merge conflict 处理(coordinator 不提前阻止)。另有项目级共享记忆、**资料库(library)**与「记住你的沟通与汇报风格」。代价很直接:每个 thread 都是一个完整 session,用量随并行数线性翻倍。当前仅云端运行,本地执行官方称「coming very soon」。详见 Claude Code Projects 重构资讯

来源说明:本文基于 code.claude.com 官方文档、Anthropic 定价页面、第三方独立评测(laozhang.ai / explainx.ai / computingforgeeks.com)综合整理。Anthropic 模型版本迭代快,命令和价格请以最新官方文档为准。

核心特性

终端原生的 Agent 体验

不像 Cursor / Windsurf 那种"AI IDE",Claude Code 是个 CLI 工具——在任何编辑器旁边开个终端,跑 claude,就进入了一个能读你整个 codebase 的对话环境。

cd your-project
claude                          # 进入交互模式
> 帮我把这个 Express 项目迁移到 Fastify,写完之后跑测试确认通过

它会自动:列出相关文件 → 给出计划 → 等你按回车确认 → 一次改多个文件 → 跑测试 → 报告结果。整个过程你可以在另一个窗口干别的,Claude Code 不抢编辑器焦点。

子代理(Sub-agents)+ 并行任务

Claude Code 2.x 引入了 子代理 机制:主对话可以派发独立的子任务到隔离 context 中跑,结果摘要返回主线。典型场景:

/subtask            # 派发独立子任务(2026-07 起取代内联子 agent)
/fork               # 复制当前会话到后台并行推进
/agents             # 管理子代理
/tasks              # 列出后台运行的子代理

computingforgeeks.com 2026 cheat sheet 整理,子代理让"一边改前端,一边改后端"这种并行操作不会污染主对话上下文。2026-07 更新后,/subtask 取代了旧的内联子 agent 写法,/fork 则能把整个会话复制一份丢到后台继续跑;会话级新增上限(WebSearch 200 次、子 agent 200 个),MCP 调用超 2 分钟自动转后台执行。

v2.1.232(2026-08-14)子 Agent 进一步强化

  • Subagent forking 默认开启:子 Agent 继承完整对话上下文与 prompt cache,减少重复计算、提升一致性;
  • @-mention 跨会话通信:用 @会话名 语法可在不同 Claude Code 会话间直接发消息(底层走 SendMessage,默认无需确认),便于多会话协同;
  • 非 teammate 的子 Agent 默认后台运行,减少主会话阻塞;
  • GitLab marketplace 支持,扩展可用命令/技能分发渠道;
  • 安全加固:修复了若干权限绕过与凭证处理漏洞,Remote Control 稳定性提升。

Projects 重构:从「文件夹」到「协调器」(2026-09-17 起 beta)

在此前很长一段时间里,多个 Claude Code 会话并行跑同一仓库,拆活、分工、缝合结果全靠人。官方于 2026-09-17 起把 Projects 重做成一套编排结构(官方公告:Projects redesigned):

你:一个目标 + 连接的仓库/上下文
        ↓
coordinator(协调器):拆任务 → 派活 → 跟踪 → 审结果 → 汇总
        ↓
thread A(云端 session,独立分支 + 仓库副本)→ 开 PR、跑测试
thread B(同上)                              → 开 PR、跑测试
thread C(同上,内部再拆 subagents / loops / workflows)
        ↓
重叠改动 = 普通 merge conflict(不提前阻止);coordinator 给合并顺序建议

几个容易看漏、但决定你怎么用它的细节:

  • 一个 thread = 一个完整 Claude Code 云端 session。开 6 条并行就按 6 倍用量算,plan 上限会比单会话快得多触顶;coordinator 与 worker 的 model / effort 可分别设置,这是控成本的主要旋钮。
  • 冲突不提前阻断。官方原话是「重合部分按普通 PR 冲突处理」——也就是说集成负载没有消失,只是被推到了 review 阶段,你的 CI 与分支保护策略必须够硬。
  • 共享记忆是项目级的。某个 thread 学到的「发版改到周五」「动 billing 前要先找谁」,会沉淀进项目记忆供后续 thread 复用;library 则收集你上传的文件与 Claude 产出的产物,新 thread 不必重新贴上下文。
  • 可用范围窄。beta 先给「使用 Claude Code cloud sessions、且 web / desktop 上没有既有 project」的 Pro / Max 订阅者;一周内扩到更多 Code 用户,Team / Enterprise 与 chat / Cowork 排在后面。既有 project 维持原样,随放量再升级。
  • 线程目前只在云端跑;官方称「在你自己机器上、走你自己的网络」即将支持。有代码不出内网要求的团队先别把它排进计划。

AI 之家 观点:这次重构真正的变化不是「能并行」,而是把并行的控制权交给了 Agent,同时把责任留在了 Git 上——分支、PR、merge conflict 这些团队已有的流程完全没变。选型的判断点因此从「它能不能拆任务」变成「你有没有足够强的 CI 去接住它拆出来的 PR」。没有 CI 兜底的团队,并行只会把集成风险放大。

Slash 命令(生产力关键)

Claude Code 内置了一套 slash 命令,是日常使用的核心:

命令用途
/init第一次进入仓库时跑,生成 CLAUDE.md(项目记忆)
/memory编辑长期记忆
/clear清空当前对话,重新开始(最被低估的命令
/compact长对话压缩,挽救快爆炸的 context window
/context显示当前 context 用量
/plan切到 plan 模式(只规划不执行)
/model切换模型(Opus / Sonnet / Haiku)
/diff看本轮所有改动
/code-review对 diff 跑代码审查
/rewind回滚到任意 checkpoint(代码 + 对话)
/mcp管理 MCP 服务器
/doctor排查环境问题
/resume /branch回到 / fork 历史对话

learn-prompting.fr 2026-04 总结:成熟团队最常用的三个是 /compact(每 20-30 分钟一次防止 context drift)、/clear(新任务开新会话)、自定义命令(写在 .claude/commands/ 提交进 git)。

MCP 集成(一等公民)

MCP 是 Anthropic 自家协议,Claude Code 是 MCP 支持最完整的客户端。配置一次 .mcp.json,Claude Code 就能在对话里调任意 MCP server 暴露的 tool:

{
  "mcpServers": {
    "postgres": {
      "command": "npx",
      "args": ["@modelcontextprotocol/server-postgres", "postgresql://..."]
    }
  }
}

之后你就能直接说"查一下 users 表里最近 7 天注册的人数"——Claude Code 自动通过 MCP 跑 SQL,结果返回对话里继续讨论。

后台 / 远程模式

/background 让当前会话脱离终端,作为后台 agent 继续跑;/teleport 把网页端会话拉到本地终端继续;/remote-control 从手机或另一台机器接管这台机器的 Claude Code 会话。这套体系是面向"agent 长时间跑"设计的,区别于 Cursor 的"实时交互"。

价格与运行成本

根据 explainx.ai 2026-06 评测Anthropic 官方定价 整理:

路径价格适用场景
BYOK(自带 API key)按 token 计费全自由,但单月烧到 $500+ 也常见
Pro$20/月(年付 ~$17)个人开发者,每天 1-4 小时
Max 5x$100/月重度用户 + Opus 模型访问
Max 20x$200/月8h+ agentic 工作流 / 团队共享
Team Premium$100/seat 年付 / $125 月付团队,含管理

周限额变化(2026-08-30 官宣):9 月 14 日起 Pro / Max / Team / 按席位 Enterprise 的标准周限额永久 +25%;5 月 13 日起的临时 +50% 促销(延期四次)9 月 13 日结束。按新基线算,相对当前 1.5x 的实际可用量减少约 17%——重度用户建议把大任务排进 9 月 13 日前,并把非强推理任务分流到 Cline + 国产模型(GLM-5.3-FlashQwen3.8-Flash)。API 按 token 计费(BYOK)不受此调整影响。

API token 价格(2026-07 公开数据):

  • Sonnet 5:促销 input $2 / output $10(至 2026-08-31),之后标准 $3 / $15 per 1M token
  • Opus 4.8:input $5 / output $25 per 1M token(已大幅低于早期 Opus 4 的 $15/$75)
  • Haiku 4.x:input $1 / output $5 per 1M token

SWE-bench Verified 参考:Opus 4.8 官方提交 87.6%、Sonnet 5 80.8%(Claude Code 内实测),是长任务编程能力的第一梯队。注意 Sonnet 5 换了新分词器,同文本 token 数约 +30%,核算成本要按实际 token 量。

ksred 博客真实使用日志:作者 8 个月用 ~100 亿 token,API 价折合 $15,000+,订阅实际只花 $800——订阅模式对重度用户极度划算,但前提是能搞定支付。

上手 5 分钟

# macOS / Linux / Windows (WSL)
curl -fsSL https://claude.ai/install.sh | bash

# macOS 用 Homebrew
brew install --cask claude-code

# Windows PowerShell
irm https://claude.ai/install.ps1 | iex

# 验证 + 登录
claude --version
claude auth login          # 走浏览器 OAuth,绑定 Pro / Max 订阅
# 或用 API key
export ANTHROPIC_API_KEY=sk-ant-...

# 进项目,启动
cd your-project
claude /init               # 生成 CLAUDE.md
claude                     # 进入交互模式

国内使用注意事项

  1. 账号:注册 claude.ai 需要海外手机号(Google Voice / Twilio 可,国内号被封死)
  2. 支付:Pro / Max 订阅只收海外信用卡(MasterCard / Visa)+ 海外账单地址。第三方平台(如老张 / DMXAPI)可用支付宝走 API 代理,但是 BYOK 模式
  3. 网络:终端 OAuth 流程对代理稳定性要求高,掉线会反复弹浏览器
  4. 替代路径:用 AiderClineDeepSeek-V3 / GLM-5.2 是国内最经济的"Claude Code 平替"思路

与同类怎么选

维度Claude CodeCursorCodex CLIAider
形态CLI(IDE 无关)AI-first IDECLICLI
长任务能力
上下文管理/compact /clear
子代理 / 并行/agents /batch部分(Bug bot)有限
MCP 支持一等公民
Git 集成每改即 commit
国内门槛高(账号+支付+网络)高(账号+支付)低(BYOK 国产模型)
价格$20-$200/月$20/月$20-$200/月仅 API 成本

选 Claude Code 如果你

  • 重视长任务自主性 + 上下文管理
  • JetBrains / Vim 用户,不想换 IDE
  • 团队需要 SSH 远程 / 后台 agent 模式
  • 已经在用 Claude Pro/Max,加 Code 是边际成本

别选 Claude Code 如果你

  • 国内、个人、预算紧(去 Aider + DeepSeek)
  • 想要纯 IDE 内 inline 体验(Cursor
  • 主要写补全而非 agent 任务(GitHub Copilot

避坑清单

  • ANTHROPIC_API_KEY 优先级最高:你以为在用 Pro 订阅,但 env 里有 key 时实际走 API 计费——卡崩之前先 env | grep ANTHROPIC 检查
  • 长会话不 /compact 会越来越笨:context 接近上限时,模型会开始忘记前面约定。社区共识:每 20-30 分钟 /compact 一次或 /clear 开新会话
  • /model 切换是个坑:跨模型切会丢部分 context 据 r/ClaudeAI 反馈;建议起新会话指定模型
  • /init 生成的 CLAUDE.md 要 review:自动生成的会有冗余/错误,第一次进项目花 5 分钟整理
  • .claude/commands/ 自定义命令是放大器:把团队最常用的工作流写成 /deploy /migrate /review-pr,提交进 git
  • 后台 agent + 重写大量文件 = 危险组合:长任务跑通常加 --permission-mode plan 或开 acceptEdits 但配合 git worktree
  • Windows 原生支持有限:官方推荐 WSL,PowerShell 安装路径有时跑不通
  • API token 烧钱速度:BYOK 模式下,复杂 refactor 单次任务可能消耗几百万 token

相关阅读

Long-tail quick picks

长尾检索速查:下面三项对应「Claude Code 开源版 / 免费版 / 国内可用」等搜索意图,方便直接跳转。

Open-source alternatives

  • 是否开源:
  • 闭源商业工具,无官方开源版;同类开源可看 Cline / Aider / OpenCode

Free tier

  • 是否有免费档:
  • 价格概要:API 按 token 计费 / Pro $20 / Max $100-$200 / Team Premium $100-$125 seat
  • 无免费档,预算敏感可转 Trae(国内版免费)或 GitHub Copilot($10/月)。

China availability

  • 是否国内可用:
  • 中文友好度评分:3 / 5
  • 国内访问需稳定代理;高频切 IP 可能触发风控。中文场景可考虑 Trae / 通义灵码 / Comate

相关替代品:

来源

本卡片由 AI 之家 编辑部根据官方公开资料与第三方评测整理。所有事实点均标注来源;如发现价格 / 命令 / 功能与最新官方信息不一致,请通过 反馈邮箱 反馈。

02 / 07价格速查
计划价格限制国内支付备注
Pay-as-go按 API token 计费Sonnet $3/$15 per Mtok,Opus $15/$75 第三方中转支持支付宝 BYOK 模式
Claude Pro$20/月约 1-4 小时/天活跃编码 需海外卡 网页 + Code 共享额度
Claude Max 5x$100/月Pro 的 5 倍 + Opus 接入 需海外卡 重度用户
Claude Max 20x$200/月Pro 的 20 倍 + 优先队列 需海外卡 8h+/天 agentic 工作流
03 / 07适合 / 不适合
适合谁
  • · JetBrains / Vim / Emacs 用户(不想换编辑器)
  • · 需要长任务自主规划(>30min 单次任务)
  • · 服务器开发、运维脚本、CI/CD 场景
  • · 需要在 SSH 远程主机上跑 AI 编程
  • · 重视稳定性 + 长上下文连贯性
不适合谁
  • · 国内裸跑(账号 / 支付 / 网络三关)
  • · 预算 ¥100/月以内的个人开发者
  • · 只想做基础代码补全(用 GitHub Copilot 更经济)
04 / 07避坑提醒
NOT FOR · 什么情况下不要选它

不适合国内裸跑的个人开发者和只想做基础补全的用户——前者账号、支付、网络三关难,后者用 Copilot 更省心

PITFALLS · 避坑提醒
  • 注册要海外手机号,Pro / Max 订阅只收海外信用卡加海外账单地址,国内用户还得自备稳定代理,三关缺一不可
  • 环境变量里有 ANTHROPIC_API_KEY 时优先级高于订阅额度,你以为在花 $20 套餐,实际按 token 走 API 计费
  • 长会话不手动 /compact 会出现 context drift,前面约定的规则被忘掉,需要每二三十分钟压一次或开新会话
  • 默认就能读写文件并直接执行 shell 命令,权限白名单没配好时可能误改仓库或跑危险命令,得自己先写 CLAUDE.md 约束
  • 2026-09-14 起标准周限额换新基线:永久 +25% 但 5 月的 +50% 促销同日到期,相对当前实际可用量少约 17%,重度用户要提前把大任务排期并规划分流
  • v2.1.275 会让所有走 ANTHROPIC_BASE_URL 代理 / 网关的请求以 400 失败,必须升到 v2.1.276+;企业网关部署请勿 fleet-wide 直推,先在灰度环境验证
  • Projects 重构后每个并行 thread 都是一个完整云端 session,用量随并行线程数线性翻倍,开多条后很容易撞上 plan 上限(2026-09 起 beta,来源:官方公告)
  • v2.1.277 的 AGENTS.md 是「回退」不是「合并」:仓库里只要存在 CLAUDE.md(哪怕空文件),AGENTS.md 就不会被读;且 Bedrock / Vertex / Foundry 暂不支持
兼容模型

可接入 / 兼容以下大模型 API(在设置中配置 key 即可切换底座):

Anthropic / Claude
06 / 07深度评测

AI 编程工具选型决策树:30 个场景告诉你该用哪个

整合 AI 之家 编辑部 11 篇深度评测的结论:按角色、预算、规模、网络环境四维度的 AI 编程工具决策树。Cursor / Claude Code / Aider / Trae / v0 / Lovable 等主流工具一图看完该选哪个,附 30 个真实场景对应表。

Aider 深度评测:把 AI 编程当 git 工作流的极客派最爱

Aider 深度评测:git-native 心智的真实代价、Architect 双模型经济学、与 Claude Code 的决策边界、何时不该选 Aider。AI 之家 编辑部基于官方文档与社区公开反馈整合,非厂商付费内容。

Claude Code 深度评测:60 个真实任务跑出来的体感

Claude Code 2026 深度评测:我们用 60 个真实任务(前端 / 后端 / 运维 / 数据 / 文档)实测长任务能力,对比 Pro / Max / API 三种计费谁更划算,做 CLAUDE.md 写法的 A/B 测试,并整理踩坑合集与常见问题。

Claude Code 深度评测:终端 AI Coding Agent 标杆

Anthropic 官方 CLI Agent 一个月真实使用报告:长任务能力、CLAUDE.md 配置、权限模型、成本控制、与 Cursor / Codex / Aider 的实操对比与选型建议。

Claude Skills 实战:用 SKILL.md 让 Agent 学会部署 Nuxt 项目

Anthropic Skills 推出后,Agent 能力复用从写代码降维到写 Markdown。我们写了 5 个实战 Skill,总结出 SKILL.md 怎么写才有效,以及它和 .cursorrules、MCP 的分工。

Codex CLI 深度评测:OpenAI 的终端 AI Agent 好用吗

Codex CLI 真实评测:OpenAI 官方开源(Apache-2.0)的终端 Coding Agent,Rust 实现、原生 Windows 沙箱、Subagents + MCP + Hooks 三件套齐活。本文写它真正解决的问题、gpt-5-codex 的代码生成质量、与 Claude Code 的实操差距、ChatGPT 订阅打包的价格经济学,以及 5 类不推荐场景。AI 之家 编辑部基于官方文档与公开评测整理。

Cursor 深度评测:AI IDE 当前天花板,但代价不便宜

Cursor 深度评测:Composer / Tab / @-symbol 三件套实战表现、2025-06 token 计费改革后的账单模型、与 Claude Code 的决策边界、国内使用避坑。AI 之家 编辑部基于官方文档与社区公开反馈整合,非厂商付费内容。

同任务替代方案

相关横评

相关工作流

Newsletter

关注这个工具的后续更新

订阅 AI 之家 周报,第一时间获取该工具版本更新、定价变动与重新评测结果。