跳到主内容
llmAnthropic

Claude Haiku 4.5

Claude Haiku 4.5 是 Anthropic 于 2025-10-15 发布的轻量档模型:200K 上下文、64K 输出、$1/$5 每百万 token,家族中延迟最低。2026-09-22 官方预告 Claude Haiku 5.5 将在未来数周发布,本卡同时说明换代窗口与退役时间口径。

发布 2026-09-25更新 2026-09-25核实 2026-09-25

规格

厂商
Anthropic
发布日期
2025/10/15
类型
llm
上下文窗口
200K tokens
最大输出
64K tokens
定价
输入 $1 / 输出 $5 每百万 token
API 兼容
anthropic, bedrock, vertex-ai

基准测试

以约 1/3 成本达到上一代 Sonnet 的编程与 Agent 水平(Anthropic 口径)
官方定位
200K / 64K
上下文 / 输出
Fastest(家族最快)
相对延迟
2025-02
知识截止
$1 / $5 每百万 token
官方定价

优势

  • •Anthropic 现役最快、最便宜的一档:$1/$5,延迟标为 Fastest
  • •200K 上下文 + 64K 输出,是 Haiku 4 的 4 倍输出上限
  • •官方定位为「以约三分之一成本达到上一代 Sonnet 的编程与 Agent 水平」
  • •支持 extended thinking,可在需要时换取推理深度
  • •官方模型总览页仍在列表内,是当前 Haiku 档的稳定选择

不足

  • •上下文 200K,只有 Opus / Sonnet 档(1M)的五分之一
  • •知识截止 2025-02,是同代家族中最早的,事实性问题必须配外部检索
  • •⚠️ 退役窗口临近:第三方口径称官方承诺「不早于 2026-10-15」,该日期距今不足一个月
  • •⚠️ 官方已预告 Claude Haiku 5.5 将在「未来数周」发布,新项目的调优投入回收期很短
  • •国内无官方 API 通道

适用场景

高并发、低延迟的补全与分类任务Agent 流水线里的「廉价第一道筛子」(路由、意图识别、格式规整)批量文本处理与数据清洗子 agent 的批量调用(主 agent 用 Sonnet/Opus,子任务用 Haiku)

概述

Claude Haiku 4.5 是 Anthropic 轻量档(Haiku)的现役模型,发布于 2025 年 10 月 15 日,规格是 200K 上下文 / 64K 最大输出 / $1/$5 每百万 token,官方模型总览页把它的相对延迟标为 Fastest——家族里最快、也最便宜的一档。

它的产品定位一句话说清:用约三分之一的代价,做到上一代 Sonnet 在编程与 Agent 任务上的水平。这意味着 Haiku 4.5 不是「便宜的凑合选项」,而是给流水线里那些「不需要最强,但需要跑很多遍」的环节准备的。

2026 年这段时间里,Haiku 档有个绕不开的话题,本卡把它讲清楚(见下节)——因为误解它的人比理解它的人多。

2026-09 的关键背景:Haiku 线「被砍」传闻与官方澄清

在 2026 年 9 月的大约两周里,圈内一度流传一个说法:5.5 代会重组产品线,Fable / Opus / Sonnet 各自升到 5.5,而 Haiku 线退出。

这个传闻并非空穴来风——它有两个看起来很像真的支撑:

  1. Haiku 档在 11 个月里没有更新。从 2025-10-15 的 Haiku 4.5 到 2026-09-22 的 Opus 5.5,期间 Opus 走了 4.5→4.6→4.7→4.8→5→5.5,Sonnet 走了 4.5→4.6→5,还多出一个 Fable 顶层;Haiku 一次没动。而这个档位历史上大约每半年更新一次。
  2. 退役时钟快跑完了。第三方口径称 Anthropic 对 Haiku 4.5 的退役承诺是「不早于 2026-10-15」——也就是说,传闻流传时距离这个日期只剩约三周。

但 Anthropic 在 2026-09-22 的 Opus 5.5 发布页里用一句话直接否掉了它:「Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来数周内跟进。」

所以当前的事实状态是三句话:

  • Haiku 5.5 已被官方宣布,但没有日期、没有规格、没有定价、没有 model ID;
  • Haiku 4.5 是当前唯一在役的 Haiku 档,你现在能调用的就是它;
  • 「Haiku 线要被砍」是错的,且纠错来自厂商本身而不是第二个爆料者。

口径纪律:上面关于「退役不早于 2026-10-15」与「11 个月未更新」的判断来自第三方行业博客的整理,AI 之家 未能从 Anthropic 官方页面直接取证,请勿据此做采购时间点决策;可确认的一手信息只有「Haiku 5.5 将在未来数周发布」这一句。

官方规格(2026-09-25 核对)

项值
模型Claude Haiku 4.5
上下文窗口200K token
最大输出64K token
输入 / 输出$1 / $5 每百万 token
相对延迟Fastest
ThinkingExtended(可按需开启,非常开)
默认 effort—(官方总览页留空)
知识截止2025-02
平台Claude API、Amazon Bedrock、Google Cloud

与同代家族的定位差

模型上下文最大输出价格 / MTok定位
Claude Fable 51M128K$10 / $50能力天花板
Claude Opus 51M128K$5 / $25长程 Agent 主力
Claude Sonnet 51M128K$2 / $10日常编程主力
Claude Haiku 4.5200K64K$1 / $5高并发 / 低延迟 / 批量

注意档位差不是线性的:Haiku 4.5 的价格是 Sonnet 5 的一半,但上下文只有五分之一。这决定了它适合的不是「便宜版的 Sonnet」,而是**「上下文要求不高、但调用次数极多」**的位置。

怎么用才划算

Haiku 4.5 的高价值用法几乎都是分层架构,而不是「拿它当主力模型用」:

  1. Agent 流水线的第一道筛子。主 agent 用 Opus / Sonnet 做规划与决策,把意图识别、格式规整、结果打分、日志摘要这类高频且不需要深度推理的环节交给 Haiku。这一步通常占调用量的大头,换成 Haiku 后账单的下降幅度远超你的直觉。
  2. 子 agent 批量调用。多 agent 编排里,子 agent 数量远多于主 agent;Claude Code 的 sub-agent、Cline 的多会话都属于这类结构。
  3. 实时补全与交互路径。Fastest 的定位让它适合用户正在等响应、且任务明确的场景。
  4. extended thinking 按需开启。它支持 extended thinking,但非常开——需要推理深度时再打开,否则你会为不需要的推理付费。

适合 / 不适合

适合

  • 高并发、低延迟的补全、分类、抽取任务;
  • Agent 流水线里的廉价前置/后置处理环节;
  • 批量文本处理与数据清洗;
  • 换代窗口期内的保守选择:Haiku 5.5 未发布、规格未定,此时 Haiku 4.5 是唯一可选。

不适合

  • 需要超长上下文的任务:200K 是硬上限,仓库级分析请上 Sonnet 5 或 Opus 5.5;
  • 2025-02 之后的事实性问题:知识截止太早,必须配检索;
  • 需要复杂多步推理的核心决策环节:这是 Opus / Sonnet 的活;
  • 为它做深度 prompt 调优的长期项目:Haiku 5.5 已在路上,调优成果可能很快需要重做。

避坑清单

  1. 别把「便宜」理解成「可以随便调」:$1/$5 是单价低,但高频场景下绝对金额一样惊人——先埋点再看账单。
  2. 换代窗口别锁太死:Haiku 5.5 官方已宣布但未定档,此刻做重投入的 prompt 工程与评测集,回收期可能只有几周。
  3. 退役日期不要自行推导:「不早于 2026-10-15」来自第三方整理而非官方页面,本站已标注,请勿写进采购时间表。
  4. 200K 上下文要留余量:装入大量检索结果后再加上系统提示与历史,很容易逼近上限,建议预留 20%。
  5. 国内直连不可用:无官方通道。

FAQ

Haiku 线真的不会被砍吗? 官方在 2026-09-22 的 Opus 5.5 发布页明确写了 「Claude Haiku 5.5 将在未来数周内跟进」。这是目前唯一的一手依据——它同时否掉了「砍线」传闻,也说明 Haiku 档会继续存在。

现在该等 Haiku 5.5 还是直接用 4.5? 如果有明确的近几周交付需求,直接用 4.5——「未来数周」没有具体日期,等待的机会成本高于换代的收益。若只是做技术预研,可以先按 4.5 的规格设计,但把模型名做成可配置,5.5 发布后只改一个字符串。

Haiku 4.5 和 Haiku 4 差多少? 最实质的差别是输出上限:Haiku 4 是 16K,4.5 是 64K(4 倍),这让它能承担更长的结构化输出。基础规格(200K 上下文、$1/$5)一致。

延伸阅读

来源

本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容。规格与定价以 Anthropic 官方模型总览页为准;「退役不早于 2026-10-15」与换代时间线的细节来自二手来源,已在正文标注,请勿据此做采购决策。欢迎在 反馈邮箱 反馈更新。

相关对比

Aider vs Claude Code:终端 AI 编程双雄怎么选

Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比

Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)

Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。

Claude Code vs Gemini CLI:终端 AI Agent 怎么选?(2026 选型指南)

Claude Code 和 Gemini CLI 都是终端原生的 AI 编码 Agent。一句话结论 + 决策树 + 价格 + 国内可用性对比:长任务与 CLAUDE.md 生态选前者,免费额度与接入门槛选后者。