OpenAI 发布 GPT-5.6 家族:Sol / Terra / Luna 三档分层,Agent 能力再进一步
2026-07-09 · OpenAI
要点
- 三档分层:Sol(旗舰)/ Terra(均衡)/ Luna(低成本),另有 Sol Ultra 高配
- 1.1M 上下文,原生 reasoning + vision
- 定价(每 1M input/output):Sol $5/$30、Terra $2.50/$15、Luna $1/$6
- 基准(Terminal-Bench 2.1):Sol Ultra 91.9% · Sol 88.8% · Terra 84.3% · Luna 82.5%
- 新特性:Programmatic Tool Calling、multi-agent beta、ultra 模式默认 4 并行 agent(最多可配 16)
- 全平台上线:OpenAI API / ChatGPT / Codex / GitHub Copilot / Devin / Microsoft 365 Copilot
从"一个旗舰"到"一条产品线"
GPT-5.6 最大的变化不在单点能力,而在产品策略:OpenAI 不再押注单一旗舰,而是同一天推出三个定位不同的型号。
| 型号 | 定位 | Input/Output(每 1M) | Terminal-Bench 2.1 |
|---|---|---|---|
| Sol Ultra | 极限能力,subagent 编排 | — | 91.9% |
| Sol | 前沿编码/Agent 默认 | $5 / $30 | 88.8% |
| Terra | 均衡,对标 GPT-5.5 价位 | $2.50 / $15 | 84.3% |
| Luna | 预算前沿 | $1 / $6 | 82.5% |
这套分层直接呼应了 2026 年整个行业的主题——模型选型从"谁最强"转向"谁在高频工作流里跑得久、花得省"。Terra 用 GPT-5.5 的价格换来更高的编码分,Luna 则把前沿能力压到 $1/$6 的入门价。
Agent 侧的两个关键升级
- Programmatic Tool Calling:模型可以用程序化方式批量编排工具调用,减少多轮往返,长任务更省 token。
- multi-agent / ultra 模式:默认拉起 4 个并行 agent,最多可配 16 个,用于把大任务拆给多个子 agent 同时干。这与 Claude Code 的
/subtask、Cursor 的/multitask是同一方向。
一段"政策时钟"插曲
GPT-5.6 在正式全球开放前,曾按美国政府要求被限制在约 20 家审核伙伴内约 14 天,直到 7-09 才对所有 ChatGPT / Codex / API 用户放开。这也是 2026 年少见的"模型发布受政策节奏影响"的案例——但从结果看,前沿模型的发布仍由竞争节奏而非政策节奏主导。
AIHO 观点
对开发者最实际的影响是模型路由:把补全类、样板类任务丢给 Luna 或 Terra,把真正需要推理的架构决策留给 Sol。在 Copilot 转向 AI Credits 按量计费后,这种"按任务选型"的省钱策略价值更明显。
如果你在 Codex / Copilot 里做重度 Agent 工作,值得先用 Sol、Terra、Luna 各跑一遍你自己的基准,再决定默认模型——发布周的榜单分数不等于你项目里的实际表现。