跳到主内容
reasoningxAI

Grok 4.7

Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿(较 Grok 4.6 的 1.5 万亿 +40%),马斯克称其工程与科学推理优于所有同类模型、token 效率更高,并以 SpaceX 工程数据补充训练。⚠️ 截至 2026-09-16,xAI 未公开 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,文档库最新条目仍为 grok-4.6,本卡参数与能力口径待核实。

发布 2026-09-16更新 2026-09-16核实 2026-09-16

规格

厂商
xAI
发布日期
2026/9/12
类型
reasoning
定价
⚠️ 待核实:截至 2026-09-16 官方未公开;前代 Grok 4.6 为 $2 / $6 每百万 token
API 兼容
openai, xai

基准测试

2.1 万亿(Grok 4.6 为 1.5 万亿,+40%)
参数规模
⚠️ 待核实:官方未公开(4.6 为 500K)
上下文窗口
⚠️ 待核实:无官方 model card 与基准套件
官方基准
AA 智能指数 61,领先 GPT-5.6 Sol,落后 Claude Opus 5 与 Fable 5
前代基线(4.6)

优势

  • 参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%,是当前公开参数量最大的前沿模型之一
  • 官方口径主打工程与科学推理,并以 SpaceX 真实工程数据做补充训练强化真实世界工程任务
  • 马斯克称 token 效率高于前代(服务速度略慢,单位 token 产出更优)
  • 延续 Grok 系列的性价比路线,前代 4.6 定价维持 $2/$6

不足

  • ⚠️ 无官方 model card、基准套件、上下文窗口与定价页,能力数据全部来自创始人陈述
  • xAI 文档库(docs.x.ai)截至发布当周仍只列到 grok-4.6,无可用 API model ID
  • 马斯克自述多模态表现仍需改进;RL 阶段过度惩罚响应长度导致过早放弃困难任务
  • 国内无官方 API,需经第三方网关或代理,稳定性与合规性自负
  • 迭代过快(4.5→4.6→4.7 不到三个月),为单代做深度调优的投入回收周期极短

适用场景

工程与科学推理类任务(官方主推方向,待独立评测验证)成本敏感的批量 Agent 调用(需等定价公开后重新核算)作为多模型路由中的规模档备选(与 Fable 5.1 / Astra 做同任务对比)

数据可信度提示(务必先读):截至 2026-09-16,xAI 未公开 Grok 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,官方模型文档最新条目仍为 grok-4.6。本卡的参数规模与能力表述来自马斯克本人在 X 的公开陈述及多家行业日报汇总,不属于官方文档口径。接入与迁移请以 xAI 官方文档为准。

概述

Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%

它的定位可以概括成一句话:用规模去补能力差。 前代 4.6 的独立评测基线是「AA 智能指数 61,领先 GPT-5.6 Sol,但仍落后 Claude Opus 5 与 Fable 5」——赢在单位成本,不是绝对天花板。4.7 把参数推到 2.1T,是 xAI 押注「规模即差距」的直接体现。

同期它也延续了 xAI 近期的激进节奏:4.5(7 月)→ 4.6(8 月)→ 4.7(9 月),不到三个月三次大版本迭代,4.8(2.5T)已排在紧随其后的日程上。

核心能力

工程与科学推理(官方主推)

马斯克的表述是:除服务速度略慢外,4.7 在工程与科学推理上「优于所有模型」。

配合「用 SpaceX 公司数据补充训练」这一动作,可以推断其能力建设方向是真实世界工程任务——火箭遥测、制造工艺、故障排查这类公开互联网几乎不存在的数据。

需要冷静看待的是:这类数据第三方无法验证,且其对应的航天/制造场景对绝大多数开发者的日常工作没有直接迁移价值。真正的检验标准仍是通用编程基准与 Agent 长任务表现,而这些数据目前都没有公开。

Token 效率

官方口径称 token 效率更高(以略慢的服务速度换取更高的单位 token 产出)。在没有定价的前提下,这一说法暂时无法换算成成本优势——效率提升与单价是两件事,只有定价公开后才能判断真实性价比

上下文与多模态

  • 上下文窗口官方未公开(前代 4.6 为 500K)。
  • 多模态:马斯克在发布前明确表示多模态表现仍需改进,属已知短板。

获取方式 / 定价

通道状态说明
xAI 官方 API待核实文档库最新条目仍为 grok-4.6,4.7 的 model ID 未公开
第三方聚合网关需等待同步通常在官方接入后同步,建议通过网关做灰度切换
国内直连无官方通道需经第三方网关或代理,稳定性与合规性自负
定价未公开前代 Grok 4.6 为 $2 / $6 每百万 token

在官方定价与 model ID 公开之前,不建议任何生产环境迁移动作。

适合 / 不适合

适合

  • 已经在用 Grok 4.6 且成本结构依赖其低价优势的团队——等 4.7 定价公开后做一次同任务对比即可,切换成本低。
  • 需要公开参数量最大档位做对比实验的研究/评测场景。
  • 把 Grok 作为多模型路由中的规模档,与 Claude Fable 5.1GPT-6 Astra 并行跑分。

不适合

  • 需要 SLA 与可预期成本的生产环境——定价、限流、上下文三项都未公开,无法做容量规划。
  • 强依赖多模态的场景——官方自述仍需改进。
  • 长程高难度 Agent 任务——马斯克自述 RL 阶段过度惩罚响应长度,导致模型「过早放弃它本可以完成的困难任务」,而这恰恰是 Agent 最关键的指标。
  • 国内合规要求严格的团队——无官方 API 通道。

与前代怎么选

维度Grok 4.6Grok 4.7
参数规模1.5 万亿2.1 万亿(+40%)
官方定价$2 / $6未公开
上下文窗口500K未公开
官方 model card
API model IDgrok-4.6未公开
独立第三方评测有(AA 指数 61)未见

结论:现阶段继续用 4.6。 4.7 的所有关键采购信息(定价、上下文、限流)都还缺位,且官方自述存在已知短板;等官方文档更新后再评估,代价远小于提前迁移。

相关阅读

来源

本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容。Grok 4.7 的官方 model card、基准、上下文窗口与定价截至 2026-09-16 尚未公开,参数与能力口径来自 xAI 创始人公开陈述;一切规格以 xAI 官方文档为准,欢迎在 反馈邮箱 反馈更新。

相关工具

相关对比

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比

Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。

Cursor vs Kiro:「对话式改代码」与「规格驱动开发」怎么选(2026)

Cursor 代表对话式、迭代式的 AI 编码;Kiro 主打 spec-driven,先写需求与设计文档再生成代码。一句话结论 + 决策树 + 价格对比:要速度与手感选 Cursor,要过程可控与可追溯选 Kiro。

Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比

Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。