一句话结论
Claude Code 和 Codex CLI 是终端 AI Agent 赛道的直接镜像竞品——Anthropic 和 OpenAI 各自做的官方 CLI Agent,形态几乎一样,差异主要在三个硬条件:你已订阅哪家、用不用 Windows、长任务稳不稳。
- 已经订阅 ChatGPT Plus / Pro → 选 Codex CLI(用量打包,近乎免费)
- 已经订阅 Claude Pro / Max → 选 Claude Code(长任务最稳、中文更懂)
- Windows 原生主力 → 偏 Codex CLI(AppContainer 沙箱,不必 WSL)
- 超长任务 / 超大 monorepo → 偏 Claude Code(Sonnet 4.5 上下文连贯性第一梯队)
- 预算和网络都允许 → 两个都装,按任务分工
不要用"哪个更强"来决定。两者底层模型不同、生态不同,是两套哲学而非同一产品的两个版本。先看你已经付了哪家的订阅,再看你的任务匹配哪种模型风格,最后才看能力高下。
核心差异
| 维度 | Claude Code | Codex CLI |
|---|---|---|
| 出品方 | Anthropic 官方 | OpenAI 官方 |
| 形态 | 终端 TUI(IDE 无关) | 终端 TUI(IDE 无关) |
| 默认模型 | Claude Sonnet / Opus 4.x | gpt-5-codex / gpt-5-codex-mini |
| 长任务稳定性 | 第一梯队 | 略逊半档 |
| 上下文管理 | /compact /clear | compaction 机制 |
| Windows 原生 | 推荐 WSL | AppContainer 沙箱 |
| MCP 生态 | 一等公民、最厚 | 支持、薄一档 |
| Subagents / 并行 | /agents /batch | GA |
| 开源 | 闭源 | Apache-2.0 |
| 订阅打包 | Claude Pro $20 单独买 | ChatGPT Plus $20 含在内 |
| 国内付款 | 需海外卡 | 支付宝 |
| 中文理解 | 更懂 | 略弱 |
| 价格 | $20-$200/月 | $20-$200/月 |
Agent 能力对比
两者都是"在终端里跑一个能读 / 改 / 执行代码的 Agent",核心交互几乎镜像:进项目目录、自然语言下指令、它自己 plan → 读文件 → 改文件 → 跑测试 → 报告结果。差异在工程细节。
沙箱与权限模型。 Claude Code 默认每个写操作、每条 shell 命令都确认,粒度可调(--dangerously-skip-permissions 或细粒度允许列表)。Codex CLI 用 Smart Approvals——只读 / 幂等命令自动放行,写操作才弹确认,外加 PostToolUse Hook 能在工具调用后插企业策略。两者思路一致,Codex CLI 的 Hook 机制更面向企业 CI 集成。
Subagents / 并行。 Claude Code 2.x 的 /agents /batch 能把大改动拆成独立单元、每个跑在自己的 git worktree,"一边改前端一边改后端"不污染主上下文。Codex CLI 的 Subagents 也做到 GA,能并行起 lint 和 test 两条线。能力对齐,Claude Code 的 worktree 集成更顺手。
远程 / 后台模式。 Claude Code 的 /background /teleport /remote-control 是面向"agent 长时间跑"设计的——会话脱离终端继续跑、网页端会话拉到本地、手机接管。Codex CLI 有 WebSocket 远程模式(codex --remote wss://...),适合 SSH / 容器场景,但远程控制体系不如 Claude Code 完整。
Slash 命令体系。 这是 Claude Code 的成熟度优势。/init /memory /compact /clear /context /plan /model /diff /code-review /rewind /mcp 一整套,长会话上下文管理(每 20-30 分钟 /compact 一次防 drift)是社区共识的最佳实践。Codex CLI 的命令体系在迭代中,成熟度薄一档。
Windows 原生是 Codex CLI 的独占优势。 Claude Code 在 Windows 官方推荐 WSL,PowerShell 原生路径经常踩坑。Codex CLI 是 Rust 二进制 + 原生 AppContainer 沙箱,PowerShell 直接跑;gpt-5.1-codex-max 更是首个原生训练支持 Windows 的模型。Windows 主力开发者,Codex CLI 体验明显更顺。
模型对比
模型偏好是两者最根本的分水岭——这不是"谁更强",是"哪套模型更对你的胃口"。
| 维度 | Claude Sonnet/Opus 4.x | gpt-5-codex 系列 |
|---|---|---|
| 定位 | 通用旗舰(强编程) | 编码专用 agent |
| SWE-bench Verified | SOTA 第一梯队 | 77.9%(max xhigh) |
| 长程工作 | 强、连贯性第一梯队 | 24h+ compaction |
| 上下文窗口 | 1M(Sonnet 4.5) | 400K(codex-max) |
| 结构化输出 | 强 | 更工整、指令遵循更稳 |
| 中文理解 | 更懂 | 略弱 |
| 通用对话 | 官方建议仅编码用 |
Claude Code 强在:长任务上下文连贯性(1M 窗口 + /compact)、中文项目理解、超长任务的稳定性。5 小时以上的长任务、超大 monorepo 跨文件重构,Sonnet 4.5 仍是体感最稳的一档。
Codex CLI 强在:结构化输出和 API 理解(OpenAPI spec 生成 client、跨语言翻译更规范)、长程 compaction(24h+ 项目级重构)、模型分层省钱(mini 跑日常、max 跑重型)。
关键认知:gpt-5-codex 是编码专用模型,官方明确建议仅用于 agentic 编码,通用对话用 gpt-5.5。而 Claude Sonnet/Opus 是通用旗舰,编码只是强项之一。这意味着 Codex CLI 在"纯编码"场景效率高、便宜,但要做"边写代码边讨论架构边写文档"的混合任务,Claude Code 的通用性更顺手。
价格对比
价格策略是 Codex CLI 对个人用户杀伤力最大的一招——和 ChatGPT 订阅打包。
Codex CLI:
| 档位 | 价格 | 关键点 |
|---|---|---|
| ChatGPT Plus | $20/月 | 含 Codex CLI 用量,mini 额度 2026-03 起 +4× |
| ChatGPT Pro | $200/月 | 更高额度 + 优先处理 + Spark 研究预览 |
| Business / Team | $25-30/用户/月起 | 团队管理 + SSO |
| 纯 API | 按 token | gpt-5.5 ≈ $1.25/$10 per 1M |
Claude Code:
| 档位 | 价格 | 关键点 |
|---|---|---|
| Claude Pro | $20/月 | 网页 + Code 共享额度,每天 1-4 小时 |
| Claude Max 5x | $100/月 | Pro 的 5 倍 + Opus 接入 |
| Claude Max 20x | $200/月 | 8h+ agentic 工作流 |
| BYOK(API) | 按 token | Sonnet $3/$15、Opus $15/$75 per 1M |
核心差异:Codex CLI 的用量打包在 ChatGPT 订阅里——已付 ChatGPT Plus $20 的人,Codex CLI 近乎免费。Claude Code 的 Pro $20 是单独买,已付 ChatGPT 的人想用 Claude Code 得再开一份订阅。
国内付款:Codex CLI 走 ChatGPT Plus 支持支付宝,门槛低于 Claude Code 的"海外卡"。但网络这关两个都绕不开,OpenAI 和 Anthropic 都要稳定代理,且都怕频繁切 IP 触发风控。
API 模式成本:重度 BYOK 用户,Claude Code 的 Sonnet $3/$15 per 1M 比 Codex CLI 的 gpt-5.5 $1.25/$10 贵,但 Claude Code 订阅模式对重度用户极度划算(有人 8 个月烧 ~100 亿 token,API 价折合 $15,000+,订阅实际只花 $800)。先估算自己的量再选订阅还是 API。
MCP 生态对比
两者都支持 MCP(Model Context Protocol),这是 Anthropic 自家协议——意味着社区写的 MCP Server 两个工具互通复用,选了 Codex CLI 也不耽误用 Claude Code 的工具生态。
但生态厚度有差距。Claude Code 是 MCP 的"一等公民",Anthropic 自家协议、支持最完整、社区 Server 最多(Smithery 上 500+ MCP Server 无缝接入)。Codex CLI 也支持 MCP,但生态厚度薄一档,部分高级特性(如 .mcp.json 配置体验)不如 Claude Code 顺。
实际影响:如果你重度依赖 MCP 接 GitHub / 数据库 / Slack / 自家内部系统,Claude Code 的生态更成熟。如果只是基础 MCP 工具调用,两者都能满足。
适合选择 Claude Code 的情况
- 已经订阅 Claude Pro / Max,不想另开订阅
- 重视长任务稳定性(5 小时+ 单次任务)
- 需要 1M token 超大上下文的超大 monorepo 场景
- 中文项目为主,需要更懂中文的模型
- 重度依赖 MCP 生态接大量外部工具
- 喜欢"边写代码边讨论架构边写文档"的混合任务(Sonnet 通用性强)
适合选择 Codex CLI 的情况
- 已经订阅 ChatGPT Plus / Pro(用量打包,近乎免费)
- Windows 原生开发者(AppContainer 沙箱,不必 WSL)
- 偏好 GPT 系输出风格(结构化工整、API 理解强)
- 需要 headless / SSH / 容器跑 Agent
- 有合规审计需求(Apache-2.0 开源、Hook 可插策略)
- 纯编码场景,想靠模型分层省钱(mini 跑日常、max 跑重型)
最佳共存方案
预算和网络都允许的开发者,两个都装是 2026 年很多一线团队的真实配置:
- 按订阅分工:日常用已订阅便宜的那个(已付 ChatGPT 用 Codex CLI、已付 Claude 用 Claude Code)
- 按任务分工:长任务 / 超大 monorepo / 中文项目切 Claude Code;结构化输出 / Windows 原生 / API 集成切 Codex CLI
- MCP 互通:两者共用同一套 MCP Server,配置一次两边都能调
- 配置协同:Claude Code 读
CLAUDE.md、Codex CLI 读AGENTS.md(或对应配置),让两份配置保持同一套项目约定
这套组合的实际支出通常是一份订阅 $20-$200,比死守一家的最高档更划算,且能吃到两套模型的优势。
AI 之家 推荐结论
- 已订阅 ChatGPT、Windows 主力、预算敏感 → Codex CLI 直接上手,边际成本几乎为零
- 已订阅 Claude、长任务为主、中文项目 → Claude Code,长任务稳定性第一梯队
- 两个订阅都没有、国内裸跑、预算紧 → 别在两个海外工具里二选一,去 Aider + DeepSeek / GLM,是国内最经济的平替
- 不确定 → 先用你已经付钱的那家对应的工具,跑 1 周真实任务再决定要不要补另一个
不要看到"SWE-bench 77.9%"或"1M 上下文"就冲付费。终端 Agent 的真实成本在 token 烧钱速度和网络稳定性,先小样验证再放开全量。