Claude Fable 5.1 / Mythos 5.1
Anthropic 2026 年 9 月 1 日发布的 Claude Fable 5.1,定位高要求推理与长程 agentic 工作,1M 上下文,$10/$50 定价不变但缓存读降至 $0.25,配套受邀制 Mythos 5.1(Project Glasswing)。
发布 2026-09-06更新 2026-09-06核实 2026-09-06规格
- 厂商
- Anthropic
- 发布日期
- 2026/9/1
- 类型
- coding
- 上下文窗口
- 1000K tokens
- 最大输出
- 128K tokens
- 定价
- $10 输入 / $50 输出 / 百万 token(缓存读 $0.25,较常规降 75%)
- API 兼容
- anthropic, bedrock, vertex-ai
基准测试
优势
- •官方定位「高要求推理与长程 agentic 工作」,是 Anthropic 当前能力天花板
- •长会话成本优化:缓存读降到 $0.25/MTok(原价 1/4),长程 Agent 的重复上下文成本大幅下降
- •HLE(带工具)65.0%、FrontierMath Tier 4 87.8%,多步研究与知识工作基准领先 GPT-6 Astra
- •新增 per-message effort、turn-scoped system messages、工具间进度播报(均 beta),长任务可控性增强
- •内容溯源(content provenance)与 thinking block 保留机制,面向企业审计
不足
- •$10/$50 旗舰定价 + 较慢延迟,日常负载官方都建议「先用 Claude Opus 5」
- •三个 breaking change:强制工具调用报错、旧模型读不了它的 thinking block、编辑历史轮次会作废 thinking block
- •Mythos 5.1 仅限 Project Glasswing 受邀方,普通企业拿不到
- •国内无官方 API,需走中转
- •仅文本 + 图片输入,无原生音视频
适用场景
概述
Claude Fable 5.1(模型 ID claude-fable-5-1)是 Anthropic 于 2026 年 9 月 1 日发布的旗舰升级,作为 6 月发布的 Fable 5 的继任者,官方定位一句话说清:「面向高要求推理与长程 agentic 工作」。它不追求日常负载的性价比——官方文档明确写着「多数工作负载请从 Claude Opus 5 开始,当 Opus 5 高 effort 档的 eval 结果仍不达标时再上 Fable 5.1」。换句话说,这是 Anthropic 能力金字塔的塔尖,专门兜住最难的活。
价格维持 $10/$50(每百万 token),真正的成本优化在缓存侧:缓存读降到 $0.25/MTok(原来 1/4 的价格)——对跑数小时、反复回读同一大上下文的长程 Agent,这项降幅比降价更实在。
配套发布的 Claude Mythos 5.1 与 Fable 5.1 共享同一套权重、规格与定价,但仅向 Project Glasswing 参与者受邀开放:Fable 版内置高风险双用途领域的额外安全护栏,Mythos 版能力更强(系统卡按更保守的 CB-1 能力等级对待)。「一个模型、两套开放策略」与同周 GPT-6 Astra 的 Critical 门控、Gemini 3.8 Flash Cyber 的 Fairwind 白名单构成同一种行业趋势:顶级安全能力全部转向分级受控开放。
核心能力
长程 agentic 编程
Fable 5.1 的主战场是「数小时级、跨几十上百步」的编程与工作流任务。OpenAI 在 GPT-6 Astra 发布材料中给出的对照里,Fable 5.1 拿到 Terminal-Bench 4.0 55.8%(Astra 57.9%,两者咬得很紧),FrontierMath Tier 4 v2 87.8%。它同时强化文档、表格、幻灯片产出——即 Claude Cowork / Claude Code 这类桌面与终端 Agent 的底座模型。
多步研究与知识工作反超
带工具的 Humanity's Last Exam(HLE)上 Fable 5.1 拿 65.0%,高于 GPT-6 Astra 的 57.2% 与 Claude Opus 5 的 63.6%——多步研究、跨文档综合这类「知识工作」场景,它目前是对比中的领先者。GPQA Diamond 93.7%。
长任务可控性:五个新增、三个破坏性变更
新增(多为 beta):
- per-message effort:对话中途改 effort 档,不炸缓存;
- turn-scoped system messages:系统消息只作用于当轮,长对话不再被全局污染;
- 工具间进度播报(
display: "updates"):Agent 干活时向用户输出可读进度; - content provenance:内容溯源标记;
- preserved thinking:thinking block 在模型切换与对话变更后仍可用。
破坏性变更(从 Fable 5 迁移必读):
- 强制工具调用(forced tool use)直接报错——不再支持;
- 旧模型读不了 Fable 5.1 的 thinking block;
- 编辑历史轮次会作废已产生的 thinking block。
在 Anthropic 阵营里的位置
| 模型 | 输入/输出(/1M) | 延迟 | 定位 |
|---|---|---|---|
| Claude Fable 5.1 | $10/$50 | 较慢 | 最难推理 + 长程 Agent 塔尖 |
| Claude Opus 5 | $5/$25 | 中等 | 日常旗舰默认起点 |
| Claude Sonnet 5 | $2/$10(促销) | 快 | 高性价比主力 |
| Claude Haiku 4.5 | $1/$5 | 最快 | 轻量高频 |
API 调用示例
import anthropic
client = anthropic.Anthropic(api_key="sk-ant-...")
resp = client.messages.create(
model="claude-fable-5-1",
max_tokens=8192,
messages=[{"role": "user", "content": "梳理这个 monorepo 的依赖结构并给出拆分方案"}],
)
print(resp.content[0].text)
云上等价模型 ID:Bedrock 为 anthropic.claude-fable-5-1,Vertex AI 与 Microsoft Foundry 均为 claude-fable-5-1。
定价(2026-09 核对)
| 项目 | 价格(每百万 token) |
|---|---|
| 输入 | $10 |
| 输出 | $50 |
| 缓存写(5 分钟) | $12.50 |
| 缓存写(1 小时) | $20 |
| 缓存读 | $0.25 |
| Batch API | 输入输出 5 折 |
官方承诺退役不早于 2027-09-01,长项目可放心绑定。
与同档模型怎么选
| 维度 | Claude Fable 5.1 | GPT-6 Astra | Gemini 3.8 Flash |
|---|---|---|---|
| 输入/输出价(/1M) | $10/$50 | $10/$50 | $0.75/$3.75(促销) |
| 多步研究/知识工作 | HLE 65.0% | 57.2% | 54.9% |
| 长程编程 | 55.8% | 57.9% | |
| computer use | — | 72.6% | 59.0% |
| 生态 | Claude Code / Cowork | Codex / ChatGPT | Antigravity / Gemini |
| 国内可用 | 需中转 | 需中转 | 需合规通道 |
决策参考:三家 $10/$50 与 $0.75/$3.75 的价位差意味着选型其实是「任务形状」问题——多步研究与知识工作选 Fable 5.1,computer use 与防御性安全选 GPT-6 Astra,高并发专业领域流水线选 Gemini 3.8 Flash。
避坑清单
- 别拿它跑日常负载:官方自己都说先试 Opus 5,Fable 5.1 是「eval 不达标再上」的最后一张牌。
- 迁移三个 breaking change:依赖强制工具调用的旧代码会直接报错;跨模型的 thinking 工作流要重新设计。
- 长会话先规划缓存:$0.25 缓存读是红利,但缓存写($12.50/$20)不便宜,高变更频率的上下文反而更贵。
- Mythos 5.1 别当常规选项:仅限 Project Glasswing 受邀方,采购时别写进默认方案。
FAQ
Q: Fable 5.1 和 Claude Opus 5 什么关系? A: 两条并行产品线:Opus 5($5/$25)是日常旗舰默认起点,Fable 5.1($10/$50)是能力塔尖,专攻长程 agentic 与最难的推理任务。官方选型建议是「先 Opus 5,eval 不够再 Fable」。
Q: 缓存读降价 75% 意味着什么? A: 长程 Agent 会反复回读同一份大上下文(代码库、文档集),这部分费用从 $1/MTok 降到 $0.25/MTok——数小时级任务的总成本可能因此下降三成以上,具体取决于上下文命中率。
Q: 国内怎么用? A: 官方 API 不直供国内,走 OpenRouter 等中转;Claude Code 订阅用户随版本更新获得。
延伸阅读
- 同门主力:Claude Sonnet 5
- 同周对手:GPT-6 Astra / Gemini 3.8 Flash
- 配套工具:Claude Code / Cursor
- 相关资讯:2026 年 9 月上旬 AI 动态盘点
- 概念:Context Engineering / Agentic Coding
来源
- Claude Fable 5.1 官方文档(Anthropic Platform)
- Claude Fable 5.1 and Mythos 5.1 发布公告(Anthropic)
- Claude Fable 5.1 & Claude Mythos 5.1 System Card(Anthropic)
- GPT-6 Astra 对比基准(Tekraze,2026-09-06 核对)
本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容;定价与基准以 Anthropic 官方页面为准,欢迎在 反馈邮箱 反馈更新。
Aider vs Claude Code:终端 AI 编程双雄怎么选
Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比
Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。
Claude Code vs Codex CLI:终端 AI Agent 双雄对比
Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。
Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)
Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。
Claude Code vs Gemini CLI:终端 AI Agent 怎么选?(2026 选型指南)
Claude Code 和 Gemini CLI 都是终端原生的 AI 编码 Agent。一句话结论 + 决策树 + 价格 + 国内可用性对比:长任务与 CLAUDE.md 生态选前者,免费额度与接入门槛选后者。