跳到主内容
AIHO 2026 全新改版上线
codingAnthropic

Claude Sonnet 5

Anthropic 2026 年 6 月 30 日发布的 Claude Sonnet 5,1M 上下文,SWE-bench Verified 85.2%,现为 claude.ai 默认模型,促销期定价 $2/$10。

发布 2026-07-20更新 2026-07-20

规格

厂商
Anthropic
发布日期
2026/6/30
类型
coding
上下文窗口
1000K tokens
最大输出
128K tokens
定价
促销 $2/$10(至 2026-08-31)· 标准 $3/$15
API 兼容
anthropic, bedrock, vertex-ai

基准测试

85.2%
SWE-bench Verified
63.2%
SWE-bench Pro
80.4%
Terminal-Bench 2.1
81.2%
OSWorld-Verified
1618 Elo
GDPval-AA v2

✓ 优势

  • SWE-bench Verified 85.2%,编程能力第一梯队
  • 1M 上下文(batch beta 可到 300K 输出)
  • 现为 claude.ai Free & Pro 默认模型,普及度高
  • 促销期定价极具竞争力($2/$10 至 8-31)
  • 首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking

⚠ 不足

  • 新分词器令同文本 token 数约 +30%,需重新核算成本
  • 国内无官方 API,需走中转
  • 促销 8-31 后回归标准价 $3/$15
  • 多模态仅支持图片,弱于 Gemini

适用场景

软件工程 / SWE-bench 类代码修复大型 codebase 分析(1M 上下文)日常编程主力(性价比高)需要安全防护的企业场景

概述

Claude Sonnet 5(模型 ID claude-sonnet-5)是 Anthropic 于 2026 年 6 月 30 日发布的新一代主力模型。1M 上下文、128K 输出(batch beta 可到 300K),知识截止 2026 年 1 月。它现已成为 claude.ai Free & Pro 的默认模型,并同步上线 Claude Code、API、Cursor、VS Code、GitHub Copilot

它是首个内置实时网络安全防护的 Sonnet,默认开启 adaptive thinking,在保持高性价比的同时把编程能力推到 SWE-bench Verified 85.2%。

核心能力

编程第一梯队

  • SWE-bench Verified 85.2%、SWE-bench Pro 63.2%
  • Terminal-Bench 2.1 80.4%、OSWorld-Verified 81.2%
  • HLE(w/tools) 57.4%、GDPval-AA v2 1618 Elo

85.2% 的 SWE-bench Verified 让它在纯代码修复任务上接近甚至超过部分旗舰模型,而价格只是旗舰的零头。

1M 上下文 + adaptive thinking

默认开启 adaptive thinking,模型会根据任务难度自动决定思考深度。1M 上下文足以塞入中大型 codebase 的全量代码,配合 Claude Code 做全仓分析非常顺手。

内置安全防护

Sonnet 5 是首个内置实时网络安全防护的 Sonnet,在企业场景下对提示注入、恶意代码生成等风险有更强的默认防御。

API 调用示例

import anthropic
client = anthropic.Anthropic(api_key="sk-ant-...")

msg = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=8000,
    messages=[{"role": "user", "content": "定位并修复这个测试失败"}],
)
print(msg.content[0].text)

定价

项目促销价(至 2026-08-31)标准价
Input$2/M$3/M
Output$10/M$15/M
Cache$0.20/M

注意 5 换用了新分词器,同样的文本 token 数约增加 30%,核算成本时不能只看单价,要按实际 token 量估算。

与同档模型怎么选

维度Claude Sonnet 5GPT-5.6 TerraGemini 3.5 Flash
编程(SWE-bench)85.2%
上下文1M1.1M1M
促销单价$2/$10$2.50/$15$1.50/$9
安全防护内置标准标准
国内可用

建议:纯代码修复、日常编程主力选 Sonnet 5(性价比 + SWE-bench 双优);终端 Agent 选 GPT-5.6;极致低价选 DeepSeek V4

避坑清单

  • 算 token 别只看单价:新分词器令 token 数 +30%,实际成本比单价看起来高。
  • 促销有期限:$2/$10 仅到 2026-08-31,之后回 $3/$15,长期预算按标准价算。
  • 1M 上下文按需用:超长上下文单次成本高,别无脑全塞。
  • 国内无直连:走 Bedrock / Vertex / 中转。

实际使用体验

日常编程主力,性价比是最大杀器。在 Cursor / Claude Code 里跑中等规模修改,Sonnet 5 的代码质量已接近旗舰 Opus,而账单只有零头。SWE-bench Verified 85.2% 不是纸面数字——在真实的「读报错 → 定位 → 修复 → 自测」循环里,它一次通过的比例明显高于上一代 Sonnet 4.5。

促销期是上车的最好时机。$2/$10 的定价配合 1M 上下文,几乎是 2026 年中最划算的前沿编程模型。但要记得新分词器让 token 数涨了约 30%,实际每次调用比账面贵一点,做预算时要留余量。

FAQ

Q: Sonnet 5 和 Opus 4.8 怎么选? A: 短任务、日常编程、成本敏感选 Sonnet 5;30 分钟以上长程 Agent、复杂多文件重构、需要极致能力的场景选 Opus 4.8。多数团队用 Sonnet 5 主力 + Opus 兜底难任务的混合策略最划算。

Q: 新分词器对成本影响多大? A: 同样的文本,token 数约增加 30%。也就是说即便促销价 $2/$10 看起来比标准价低,实际每次调用的 token 消耗比旧模型多,核算时要按实际 token 量而非字符数估算。

Q: 国内怎么用? A: 官方 API 不直供国内,走 AWS Bedrock、Google Vertex AI 或 OpenRouter 等中转。

延伸阅读