跳到主内容
AIHO 2026 全新改版上线
codingOpenAI

GPT-5.6(Sol / Terra / Luna)

OpenAI 2026 年 7 月 9 日全量 GA 的 GPT-5.6 家族,分 Sol/Terra/Luna 三档,1.1M 上下文,Terminal-Bench 2.1 最高 91.9%,全平台覆盖。

发布 2026-07-20更新 2026-07-20

规格

厂商
OpenAI
发布日期
2026/7/9
类型
coding
上下文窗口
1100K tokens
最大输出
128K tokens
定价
Sol $5/$30 · Terra $2.50/$15 · Luna $1/$6
API 兼容
openai, azure-openai

基准测试

91.9%
Terminal-Bench 2.1(Sol Ultra)
88.8%
Terminal-Bench 2.1(Sol)
53.6
Agents' Last Exam(Sol)
80
AA Coding Agent Index(Sol)

✓ 优势

  • Terminal-Bench 2.1 最高 91.9%(Sol Ultra),编程与终端 Agent 能力顶尖
  • 1.1M 超长上下文,reasoning + vision 全能
  • 三档分级(Sol/Terra/Luna)覆盖旗舰到低成本,选型灵活
  • Programmatic Tool Calling + multi-agent,Agent 能力原生增强
  • 全平台覆盖:API/ChatGPT/Codex/Copilot/Devin/M365

⚠ 不足

  • Sol 旗舰定价偏高($5/$30),高吞吐成本压力大
  • 国内无官方 API,需走中转或 Azure
  • 发布前曾被美政府要求限制 14 天,合规环境敏感
  • ultra 模式多 agent 并行 token 消耗高

适用场景

终端 / 命令行 Agent 自动化大型软件工程与多步推理multi-agent 编排任务长文档 / 大代码库分析(1.1M 上下文)

概述

GPT-5.6 是 OpenAI 于 2026 年 7 月 9 日全量 GA 的新一代旗舰家族,分为三档:Sol(旗舰)、Terra(均衡)、Luna(低成本),另有 Sol Ultra / Pro 高配版本。全系 1.1M 上下文,具备 reasoning 与 vision 能力。它在 Terminal-Bench 2.1 上以 Sol Ultra 91.9% 的成绩刷新终端 Agent 能力上限,是 2026 下半年编程赛道的标杆之一。

发布前,GPT-5.6 曾被美国政府要求限制 14 天(约 20 家审核伙伴先行评估),7 月 9 日面向全球开放。前代 GPT-5.5 仍在服务,GPT-6 传闻在 2026 下半年(尚未官宣)。

核心能力

编程与终端 Agent SOTA

  • Terminal-Bench 2.1:Sol Ultra 91.9% / Sol 88.8% / Terra 84.3% / Luna 82.5%
  • Agents' Last Exam:Sol 53.6
  • Artificial Analysis Coding Agent Index:Sol 80

Terminal-Bench 衡量的是模型在真实命令行环境里独立完成任务的能力——这正是 Agent 编程的核心场景。

三档分级,按需选型

档位定位InputOutput
Sol旗舰$5/M$30/M
Terra均衡$2.50/M$15/M
Luna低成本$1/M$6/M

Luna 以极低价格提供 82.5% 的 Terminal-Bench 成绩,性价比突出;Sol 则用于对能力天花板要求最高的场景。

原生 Agent 增强

  • Programmatic Tool Calling:模型可编程式地组合调用工具,减少往返
  • multi-agent(beta):原生多 Agent 协作
  • ultra 模式:默认 4 个并行 Agent(最多 16),适合复杂任务并行拆解

全平台覆盖

GPT-5.6 同步上线 OpenAI API、ChatGPT、CodexGitHub Copilot、Devin、Microsoft 365 Copilot,是覆盖面最广的前沿模型之一。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="sk-...")

resp = client.responses.create(
    model="gpt-5.6-terra",   # sol / terra / luna
    input="重构这个模块并补全类型注解",
)
print(resp.output_text)

定价

见上文三档表格。Terra 是多数团队的甜点档——能力接近 Sol 的九成,价格却只有一半。Luna 适合高频、成本敏感的批量任务。

与同档模型怎么选

维度GPT-5.6 SolClaude Sonnet 5Gemini 3.1 Pro
编程Terminal-Bench 88.8%SWE-bench 85.2%
上下文1.1M1M2M
多模态reasoning + vision图片原生全模态
Agent 编排★★★★★(multi-agent)★★★★☆★★★★☆
国内可用

建议:终端/命令行 Agent 与 multi-agent 编排选 Sol;日常编程用 Terra 性价比最优;要极致低价选 Luna 或 DeepSeek V4

避坑清单

  • 别默认拉 Sol 已能覆盖绝大多数编程任务,成本只有一半。
  • ultra 模式慎用:16 并行 Agent 的 token 账单会快速膨胀,仅在真正需要并行的复杂任务用。
  • 国内无直连:需 Azure OpenAI 或第三方中转。
  • 1.1M 上下文不是免费午餐:超长上下文单次调用成本高,按需截取。

FAQ

Q: Sol、Terra、Luna 怎么选? A: Terra 是默认推荐——能力接近 Sol 九成,价格一半。只有对能力天花板要求极高(复杂 Agent、刁钻 bug)才上 Sol;高频批量、成本敏感的任务用 Luna。

Q: GPT-5.6 和 Claude Sonnet 5 哪个更适合编程? A: 各有所长。GPT-5.6 在终端 Agent(Terminal-Bench)上领先,multi-agent 编排原生;Sonnet 5 在 SWE-bench Verified 上 85.2% 略高,且促销期定价更低($2/$10)。终端自动化选 GPT-5.6,纯代码修复 Bug 可优先试 Sonnet 5。

Q: 国内怎么用? A: 官方 API 不直供国内,走 Azure OpenAI(需海外账号)或 OpenRouter 等中转。

延伸阅读