OpenAI 十月三连更:GPT-6.1 Sol 上线 Ultrafast 档并首次支持欧盟数据驻留,Codex 转向更快、Composer 开始预测你的下一句
OpenAI 于 2026-10-08 在 Responses API 为 GPT-6.1 Sol 新增 Ultrafast 服务档(6 倍标准价,首次支持美国与欧盟数据驻留),同日推出 Codex 快速转向与 ChatGPT 按角色管理插件,10-09 Codex Composer predictions 进入 beta。
2026-10-11 · OpenAI 官方 Release Notes(2026-10-07~10-09 条目,一手逐条核对)
发布 2026-10-11核实 2026-10-11要点
- Ultrafast 档落地 GPT-6.1 Sol(2026-10-08,API,GA)。官方 Release Notes 原文:"Added Ultrafast mode for GPT‑6.1 Sol in the Responses API. Use
gpt-6.1-solwithservice_tier: \"ultrafast\"to reduce the time between generated output tokens. It is available to all API users, subject to rate limits, with global processing and US and EU data residency." - 这是 Ultrafast 档第一次带上欧盟数据驻留。对照 2026-09-29 上线的 GPT-6 Astra Ultrafast 条目(官方写 "global processing and US data residency"),Astra 的 Ultrafast 只支持美国驻留;本次 Sol 的条目明确扩展到 US and EU。对数据出境有合同约束的欧洲团队,第一次有了能留在欧盟境内的提速档——而且是更便宜的那一档。
- Codex 快速转向(2026-10-08,GA):在 ChatGPT 桌面端,向正在跑的任务发一条后续消息时,Codex 能更快响应你的变更。可在 Settings → General → Follow-up behavior 里选择后续消息是立即转向当前运行还是等下一轮。
- ChatGPT 按角色管理插件(2026-10-08,GA):企业版 / 教育版工作区(已开启 RBAC)的 owner 与管理员可为角色设置插件默认值 Available / Install / Disabled,自定义角色可继承 Default。
- Codex Composer predictions(2026-10-09,beta):根据当前 Codex 线程的对话建议你的下一条消息,按 Tab 采纳后再编辑发送。面向 18 岁以上个人 ChatGPT Pro 用户,支持 GPT-6 Astra 与 GPT-6.1 Sol 的本地与 SSH 线程;默认开启,可在 General settings 关闭。beta 期间生成预测不计入 Codex 用量、不消耗 credits,但你发出的消息照常计费。
- chat-latest 快照更新(2026-10-07,API):该快照指向 ChatGPT 中 Plus / Pro / Business / Enterprise 可用的最新模型;官方明确生产环境 API 建议使用 GPT-6 模型家族,
chat-latest只适合测试聊天场景的最新改进。
来源层级:以上六条全部来自 OpenAI 官方 Release Notes 页面原文,本站逐条核对,属一手来源。英文引号内为官方原文引述。
背景与分析
「服务档」正在成为比「模型档」更常用的调节旋钮
Ultrafast 是 OpenAI 在 DevDay 2026 推出的服务层级(service tier),它不是新模型,而是同一模型的更快服务方式。目前同一模型存在四档处理方式:
| 处理档 | 相对标准价 | 适用场景 |
|---|---|---|
| Batch / Flex | 约 5 折 | 离线批处理、不要求时效 |
| Standard | 1x | 默认 |
| Fast(原名 Priority,2026-07-30 改名) | 2x | 有一定时效要求 |
| Ultrafast | 6x | 有人在等结果的交互路径 |
关键判断是:6 倍价格只应该花在「有人正在盯着屏幕等」的路径上。后台跑的代码审查、批量迁移、夜间回归,走 Batch 或 Standard 就够——把 Ultrafast 用在后台作业上,是把 6 倍成本买了一个没人感知的加速。
本站口径声明:上表的「Fast 2x / Ultrafast 6x」倍数来自 OpenAI 模型页与第三方对定价表的转引,本站未逐行打开官方定价页核对该表全部数字;唯一逐字核对过的官方原文是上文 Release Notes 的那一段(其中不含价格)。做预算前请以官方定价页为准。
欧盟数据驻留:这次是「便宜的那档先有」
这条容易被当成脚注,但对欧洲团队是实质利好:
| 模型 | Ultrafast 上线日 | 官方写明的数据驻留 |
|---|---|---|
| GPT-6 Astra | 2026-09-29 | 全球处理 + 仅美国 |
| GPT-6.1 Sol | 2026-10-08 | 全球处理 + 美国与欧盟 |
也就是说:想要「快」且「留在欧洲」,今天只能选 Sol。考虑到 Sol 的标准价($2/$10)本身就是 Astra($10/$50)的五分之一,这次组合出的性价比区间是此前不存在的。
Codex 的两条更新指向同一件事:缩短「人在环内」的往返
快速转向解决的是「跑偏了要多久才能拉回来」,Composer predictions 解决的是「下一句该说什么」。两者都在压同一个指标——人类纠错的往返延迟。
Composer predictions 有个细节值得注意:beta 期间生成预测不计费,但采纳后你发出去的消息照常计费。这说明 OpenAI 很清楚这类功能的真实成本不在推理,而在它诱导出的额外轮次。做成本模型的团队别只看「预测免费」。
配置上,快速转向的默认行为需要在 Settings → General → Follow-up behavior 里确认——这个开关决定你发的后续消息是打断当前运行还是排队,对长任务的体验差别很大。
AI 之家 观点
- 服务档会变成 agent 成本模型的一等公民。 过去做预算只算「输入 / 输出 / 缓存」三项,现在要加第四项:你想让这个 token 多快到。建议按接口分档——交互路径 Fast/Ultrafast,后台路径 Batch/Standard——而不是全局设一个档。
- 别把 Ultrafast 当性能优化。 它买的是输出 token 之间的间隔(官方原文:"to reduce the time between generated output tokens"),不是更强的推理。任务做不对,加速只会让你更快地得到错误答案。先调
reasoning.effort,再考虑服务档。 - 欧盟驻留落地在 Sol 而不是 Astra,说明驻留能力与算力调度强相关。 别假设「旗舰档一定会先有合规能力」——实际顺序可能相反,选型时要逐档查官方驻留说明。
- 对使用 Codex 的团队:自 2026-10-07 的 v0.161.0 起 Codex 默认模型已切到 GPT-6.1 Sol(官方 Release Notes 原文确认)。如果你的流水线依赖 GPT-6 Astra,升级前请显式固定模型。详见 Codex 工具卡。
待核实
- Ultrafast 的具体定价数字:多家第三方转引给出 Sol Ultrafast 为 $12 输入 / $60 输出每百万 token(标准档的 6 倍),且 超过 272K 输入 token 的请求按整单 2 倍输入与缓存、1.5 倍输出计价。本站未直接打开官方定价页逐行核对,此处仅记录第三方口径,不作为定价依据。
- 区域处理附加费:第三方称对 2026-03-05 及之后发布的模型,区域处理(数据驻留)端点加收 10%,FedRAMP 端点同样加收 10%。未获官方原文确认。
- Composer predictions 的地域与年龄限制:官方写「18 岁以上个人 ChatGPT Pro 用户、所有受支持地区」,未列具体地区清单。
- GPT-6.1 Sol 是否在普通 Chat 提供:DevDay 公告写明 ChatGPT Work 与 Codex 可用、Chat 暂未提供;本次 Release Notes 未更新该状态。