GPT-5.6(Sol / Terra / Luna)
OpenAI 2026 年 7 月 9 日全量 GA 的 GPT-5.6 家族,分 Sol/Terra/Luna 三档,1.1M 上下文,Terminal-Bench 2.1 最高 91.9%,全平台覆盖。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- OpenAI
- 发布日期
- 2026/7/9
- 类型
- coding
- 上下文窗口
- 1100K tokens
- 最大输出
- 128K tokens
- 定价
- Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6
- API 兼容
- openai, azure-openai
基准测试
✓ 优势
- •Terminal-Bench 2.1 最高 91.9%(Sol Ultra),编程与终端 Agent 能力顶尖
- •1.1M 超长上下文,reasoning + vision 全能
- •三档分级(Sol/Terra/Luna)覆盖旗舰到低成本,选型灵活
- •Programmatic Tool Calling + multi-agent,Agent 能力原生增强
- •全平台覆盖:API/ChatGPT/Codex/Copilot/Devin/M365
⚠ 不足
- •Sol 旗舰定价偏高($5/$30),高吞吐成本压力大
- •国内无官方 API,需走中转或 Azure
- •发布前曾被美政府要求限制 14 天,合规环境敏感
- •ultra 模式多 agent 并行 token 消耗高
适用场景
概述
GPT-5.6 是 OpenAI 于 2026 年 7 月 9 日全量 GA 的新一代旗舰家族,分为三档:Sol(旗舰)、Terra(均衡)、Luna(低成本),另有 Sol Ultra / Pro 高配版本。全系 1.1M 上下文,具备 reasoning 与 vision 能力。它在 Terminal-Bench 2.1 上以 Sol Ultra 91.9% 的成绩刷新终端 Agent 能力上限,是 2026 下半年编程赛道的标杆之一。
发布前,GPT-5.6 曾被美国政府要求限制 14 天(约 20 家审核伙伴先行评估),7 月 9 日面向全球开放。前代 GPT-5.5 仍在服务,GPT-6 传闻在 2026 下半年(尚未官宣)。
核心能力
编程与终端 Agent SOTA
- Terminal-Bench 2.1:Sol Ultra 91.9% / Sol 88.8% / Terra 84.3% / Luna 82.5%
- Agents' Last Exam:Sol 53.6
- Artificial Analysis Coding Agent Index:Sol 80
Terminal-Bench 衡量的是模型在真实命令行环境里独立完成任务的能力——这正是 Agent 编程的核心场景。
三档分级,按需选型
| 档位 | 定位 | Input | Output |
|---|---|---|---|
| Sol | 旗舰 | $5/M | $30/M |
| Terra | 均衡 | $2.50/M | $15/M |
| Luna | 低成本 | $1/M | $6/M |
Luna 以极低价格提供 82.5% 的 Terminal-Bench 成绩,性价比突出;Sol 则用于对能力天花板要求最高的场景。
原生 Agent 增强
- Programmatic Tool Calling:模型可编程式地组合调用工具,减少往返
- multi-agent(beta):原生多 Agent 协作
- ultra 模式:默认 4 个并行 Agent(最多 16),适合复杂任务并行拆解
全平台覆盖
GPT-5.6 同步上线 OpenAI API、ChatGPT、Codex、GitHub Copilot、Devin、Microsoft 365 Copilot,是覆盖面最广的前沿模型之一。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="sk-...")
resp = client.responses.create(
model="gpt-5.6-terra", # sol / terra / luna
input="重构这个模块并补全类型注解",
)
print(resp.output_text)
定价
见上文三档表格。Terra 是多数团队的甜点档——能力接近 Sol 的九成,价格却只有一半。Luna 适合高频、成本敏感的批量任务。
与同档模型怎么选
| 维度 | GPT-5.6 Sol | Claude Sonnet 5 | Gemini 3.1 Pro |
|---|---|---|---|
| 编程 | Terminal-Bench 88.8% | SWE-bench 85.2% | 强 |
| 上下文 | 1.1M | 1M | 2M |
| 多模态 | reasoning + vision | 图片 | 原生全模态 |
| Agent 编排 | ★★★★★(multi-agent) | ★★★★☆ | ★★★★☆ |
| 国内可用 | ❌ | ❌ | ❌ |
建议:终端/命令行 Agent 与 multi-agent 编排选 Sol;日常编程用 Terra 性价比最优;要极致低价选 Luna 或 DeepSeek V4。
避坑清单
- 别默认拉 Sol
已能覆盖绝大多数编程任务,成本只有一半。 - ultra 模式慎用:16 并行 Agent 的 token 账单会快速膨胀,仅在真正需要并行的复杂任务用。
- 国内无直连:需 Azure OpenAI 或第三方中转。
- 1.1M 上下文不是免费午餐:超长上下文单次调用成本高,按需截取。
FAQ
Q: Sol、Terra、Luna 怎么选? A: Terra 是默认推荐——能力接近 Sol 九成,价格一半。只有对能力天花板要求极高(复杂 Agent、刁钻 bug)才上 Sol;高频批量、成本敏感的任务用 Luna。
Q: GPT-5.6 和 Claude Sonnet 5 哪个更适合编程? A: 各有所长。GPT-5.6 在终端 Agent(Terminal-Bench)上领先,multi-agent 编排原生;Sonnet 5 在 SWE-bench Verified 上 85.2% 略高,且促销期定价更低($2/$10)。终端自动化选 GPT-5.6,纯代码修复 Bug 可优先试 Sonnet 5。
Q: 国内怎么用? A: 官方 API 不直供国内,走 Azure OpenAI(需海外账号)或 OpenRouter 等中转。
延伸阅读
- 对比同档:Claude Sonnet 5 / Grok 4.5 / Gemini 3 Pro
- 配套工具:Codex CLI / GitHub Copilot
- 相关资讯:GPT-5.6 发布