跳到主内容
AIHO 2026 全新改版上线

OpenAI 发布 GPT-5.6 家族:Sol / Terra / Luna 三档分层,Agent 能力再进一步

2026-07-09 · OpenAI

要点

  • 三档分层:Sol(旗舰)/ Terra(均衡)/ Luna(低成本),另有 Sol Ultra 高配
  • 1.1M 上下文,原生 reasoning + vision
  • 定价(每 1M input/output):Sol $5/$30、Terra $2.50/$15、Luna $1/$6
  • 基准(Terminal-Bench 2.1):Sol Ultra 91.9% · Sol 88.8% · Terra 84.3% · Luna 82.5%
  • 新特性:Programmatic Tool Calling、multi-agent beta、ultra 模式默认 4 并行 agent(最多可配 16)
  • 全平台上线:OpenAI API / ChatGPT / Codex / GitHub Copilot / Devin / Microsoft 365 Copilot

从"一个旗舰"到"一条产品线"

GPT-5.6 最大的变化不在单点能力,而在产品策略:OpenAI 不再押注单一旗舰,而是同一天推出三个定位不同的型号。

型号定位Input/Output(每 1M)Terminal-Bench 2.1
Sol Ultra极限能力,subagent 编排91.9%
Sol前沿编码/Agent 默认$5 / $3088.8%
Terra均衡,对标 GPT-5.5 价位$2.50 / $1584.3%
Luna预算前沿$1 / $682.5%

这套分层直接呼应了 2026 年整个行业的主题——模型选型从"谁最强"转向"谁在高频工作流里跑得久、花得省"。Terra 用 GPT-5.5 的价格换来更高的编码分,Luna 则把前沿能力压到 $1/$6 的入门价。

Agent 侧的两个关键升级

  • Programmatic Tool Calling:模型可以用程序化方式批量编排工具调用,减少多轮往返,长任务更省 token。
  • multi-agent / ultra 模式:默认拉起 4 个并行 agent,最多可配 16 个,用于把大任务拆给多个子 agent 同时干。这与 Claude Code 的 /subtask、Cursor 的 /multitask 是同一方向。

一段"政策时钟"插曲

GPT-5.6 在正式全球开放前,曾按美国政府要求被限制在约 20 家审核伙伴内约 14 天,直到 7-09 才对所有 ChatGPT / Codex / API 用户放开。这也是 2026 年少见的"模型发布受政策节奏影响"的案例——但从结果看,前沿模型的发布仍由竞争节奏而非政策节奏主导。

AIHO 观点

对开发者最实际的影响是模型路由:把补全类、样板类任务丢给 Luna 或 Terra,把真正需要推理的架构决策留给 Sol。在 Copilot 转向 AI Credits 按量计费后,这种"按任务选型"的省钱策略价值更明显。

如果你在 Codex / Copilot 里做重度 Agent 工作,值得先用 Sol、Terra、Luna 各跑一遍你自己的基准,再决定默认模型——发布周的榜单分数不等于你项目里的实际表现。

相关阅读