Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1(2026-09-01):1M 上下文,缓存读降价 75%
2026-09-12 · Anthropic 官方 API 发布说明(2026-09-01)+ 应用发布说明与第三方报道整合
要点
- 发布时间:2026-09-01,Claude Fable 5.1(面向大众)与 Claude Mythos 5.1(受邀制)同步发布,是 Claude Fable 5 的后继模型。
- 规格:默认 1M token 上下文、128k 最大输出 token、自适应思考(adaptive thinking)常开。
- 定价:$10 输入 / $50 输出 每百万 token,与 Fable 5 持平;但 缓存读降至 $0.25/MTok,为常规输入价的 0.025 倍(其他模型为 0.1 倍),相当于 降 75%。
- ** Mythos 5.1 受限**:仅面向 Project Glasswing 受邀组织,定位网络防御与生命科学研发;二者底层架构相同,差异仅在安全防护等级。
- 可用性:Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundry 均已上线。
- Breaking change:Fable 5.1 / Mythos 5.1 不支持
tool_choice的any与tool类型,会返回 400;auto/none不变。
本文为 AI 之家 基于 Anthropic 官方 API / 应用发布说明与公开报道整合;基准以 Claude Fable 5.1 模型卡 为准。
背景与分析
Fable 5.1 的发布策略很清晰:把旗舰能力向长程 agentic 工作倾斜,同时用缓存降价对冲长会话成本。Anthropic 在发布说明里把它定位为「长时运行的代理式编程、知识工作与研究」的模型,并强调 Mythos 5.1 通过可信访问计划提供给网络防御者与生命科学家。
这种「同一架构、分两档安全」的拆分发售,是前沿实验室在「能力开放」与「高风险能力管控」之间找平衡的典型做法——大众拿到的 Fable 5.1 足以覆盖绝大多数编码与知识工作,而 Mythos 5.1 把网络 / 生物方向的强能力收在受邀门槛之后。
价格上的关键动作是 缓存读 $0.25/MTok:长程 agent 反复读同一段上下文(系统提示、代码库索引、项目记忆)时,缓存命中成本骤降,直接削弱了「长会话 = 烧钱」的痛点。对跑数小时级 Claude Code 任务的团队,这是比单纯降价更对症的优化。
对生态的连锁反应
- 与 GPT-6 Astra 同日错位竞争:OpenAI GPT-6 Astra 9-3 发布、定价 $10/$50;Fable 5.1 9-1 发布、同价但缓存读更便宜——两家在「旗舰同价」下用 缓存策略 和 长上下文性价比 拉开差异。
- Claude Code 直接受益:Fable 5.1 是 Claude Code 长任务的底层支撑之一,缓存降价使多小时 agentic 工作流的单位成本下降。
tool_choice限制需关注:依赖tool_choice: any/tool的存量代码会在 Fable 5.1 / Mythos 5.1 上直接 400,迁移时要改回auto/none。
AI 之家 观点
Fable 5.1 最值得记的不是「又强了一点」,而是 Anthropic 用缓存降价把长程 agent 的经济账算明白了。在 9 月这波旗舰发布里,OpenAI 押 computer use 与长程控制面、Google 押 Flash 性价比与安全特化、Anthropic 押长上下文 + 缓存降本——三家路线分明,开发者可以按「任务时长 × 调用频次 × 安全门槛」来选,而不是无脑追最高跑分。
补充一点实测视角:Fable 5.1 在 HLE(带工具)达 65.0%、FrontierMath Tier 4 87.8%,多步研究与知识工作基准领先 GPT-6 Astra;但日常负载 Anthropic 官方都建议「先用 Claude Opus 5」——旗舰不等于默认档,成本控制仍是工程决策。
相关阅读
- 模型卡:Claude Fable 5.1 / Mythos 5.1
- 同周发布:GPT-6 Astra · Gemini 3.8 Flash
- 工具落地:Claude Code · Cursor
- 编程工具周报:2026-09-12 AI 编程周报