Claude Sonnet 5
Anthropic 2026 年 6 月 30 日发布的 Claude Sonnet 5,1M 上下文,SWE-bench Verified 85.2%,现为 claude.ai 默认模型,促销期定价 $2/$10。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- Anthropic
- 发布日期
- 2026/6/30
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 128K tokens
- 定价
- 促销 $2/$10(至 2026-08-31)· 标准 $3/$15
- API 兼容
- anthropic, bedrock, vertex-ai
基准测试
✓ 优势
- •SWE-bench Verified 85.2%,编程能力第一梯队
- •1M 上下文(batch beta 可到 300K 输出)
- •现为 claude.ai Free & Pro 默认模型,普及度高
- •促销期定价极具竞争力($2/$10 至 8-31)
- •首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking
⚠ 不足
- •新分词器令同文本 token 数约 +30%,需重新核算成本
- •国内无官方 API,需走中转
- •促销 8-31 后回归标准价 $3/$15
- •多模态仅支持图片,弱于 Gemini
适用场景
概述
Claude Sonnet 5(模型 ID claude-sonnet-5)是 Anthropic 于 2026 年 6 月 30 日发布的新一代主力模型。1M 上下文、128K 输出(batch beta 可到 300K),知识截止 2026 年 1 月。它现已成为 claude.ai Free & Pro 的默认模型,并同步上线 Claude Code、API、Cursor、VS Code、GitHub Copilot。
它是首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking,在保持高性价比的同时把编程能力推到 SWE-bench Verified 85.2%。
核心能力
编程第一梯队
- SWE-bench Verified 85.2%、SWE-bench Pro 63.2%
- Terminal-Bench 2.1 80.4%、OSWorld-Verified 81.2%
- HLE(w/tools) 57.4%、GDPval-AA v2 1618 Elo
85.2% 的 SWE-bench Verified 让它在纯代码修复任务上接近甚至超过部分旗舰模型,而价格只是旗舰的零头。
1M 上下文 + adaptive thinking
默认开启 adaptive thinking,模型会根据任务难度自动决定思考深度。1M 上下文足以塞入中大型 codebase 的全量代码,配合 Claude Code 做全仓分析非常顺手。
内置安全防护
Sonnet 5 是首个内置实时网络安全防护的 Sonnet,在企业场景下对提示注入、恶意代码生成等风险有更强的默认防御。
API 调用示例
import anthropic
client = anthropic.Anthropic(api_key="sk-ant-...")
msg = client.messages.create(
model="claude-sonnet-5",
max_tokens=8000,
messages=[{"role": "user", "content": "定位并修复这个测试失败"}],
)
print(msg.content[0].text)
定价
| 项目 | 促销价(至 2026-08-31) | 标准价 |
|---|---|---|
| Input | $2/M | $3/M |
| Output | $10/M | $15/M |
| Cache | $0.20/M | — |
注意
与同档模型怎么选
| 维度 | Claude Sonnet 5 | GPT-5.6 Terra | Gemini 3.5 Flash |
|---|---|---|---|
| 编程(SWE-bench) | 85.2% | 强 | 中 |
| 上下文 | 1M | 1.1M | 1M |
| 促销单价 | $2/$10 | $2.50/$15 | $1.50/$9 |
| 安全防护 | 内置 | 标准 | 标准 |
| 国内可用 | ❌ | ❌ | ❌ |
建议:纯代码修复、日常编程主力选 Sonnet 5(性价比 + SWE-bench 双优);终端 Agent 选 GPT-5.6;极致低价选 DeepSeek V4。
避坑清单
- 算 token 别只看单价:新分词器令 token 数 +30%,实际成本比单价看起来高。
- 促销有期限:$2/$10 仅到 2026-08-31,之后回 $3/$15,长期预算按标准价算。
- 1M 上下文按需用:超长上下文单次成本高,别无脑全塞。
- 国内无直连:走 Bedrock / Vertex / 中转。
实际使用体验
日常编程主力,性价比是最大杀器。在 Cursor / Claude Code 里跑中等规模修改,Sonnet 5 的代码质量已接近旗舰 Opus,而账单只有零头。SWE-bench Verified 85.2% 不是纸面数字——在真实的「读报错 → 定位 → 修复 → 自测」循环里,它一次通过的比例明显高于上一代 Sonnet 4.5。
促销期是上车的最好时机。$2/$10 的定价配合 1M 上下文,几乎是 2026 年中最划算的前沿编程模型。但要记得新分词器让 token 数涨了约 30%,实际每次调用比账面贵一点,做预算时要留余量。
FAQ
Q: Sonnet 5 和 Opus 4.8 怎么选? A: 短任务、日常编程、成本敏感选 Sonnet 5;30 分钟以上长程 Agent、复杂多文件重构、需要极致能力的场景选 Opus 4.8。多数团队用 Sonnet 5 主力 + Opus 兜底难任务的混合策略最划算。
Q: 新分词器对成本影响多大? A: 同样的文本,token 数约增加 30%。也就是说即便促销价 $2/$10 看起来比标准价低,实际每次调用的 token 消耗比旧模型多,核算时要按实际 token 量而非字符数估算。
Q: 国内怎么用? A: 官方 API 不直供国内,走 AWS Bedrock、Google Vertex AI 或 OpenRouter 等中转。
延伸阅读
- 对比同档:GPT-5.6 / Claude Opus 4.5 / Grok 4.5
- 配套工具:Claude Code / Cursor
- 相关资讯:Claude Sonnet 5 发布