Grok 4.7
Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿(较 Grok 4.6 的 1.5 万亿 +40%),马斯克称其工程与科学推理优于所有同类模型、token 效率更高,并以 SpaceX 工程数据补充训练。⚠️ 截至 2026-09-16,xAI 未公开 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,文档库最新条目仍为 grok-4.6,本卡参数与能力口径待核实。
发布 2026-09-16更新 2026-09-16核实 2026-09-16规格
- 厂商
- xAI
- 发布日期
- 2026/9/12
- 类型
- reasoning
- 定价
- ⚠️ 待核实:截至 2026-09-16 官方未公开;前代 Grok 4.6 为 $2 / $6 每百万 token
- API 兼容
- openai, xai
基准测试
优势
- •参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%,是当前公开参数量最大的前沿模型之一
- •官方口径主打工程与科学推理,并以 SpaceX 真实工程数据做补充训练强化真实世界工程任务
- •马斯克称 token 效率高于前代(服务速度略慢,单位 token 产出更优)
- •延续 Grok 系列的性价比路线,前代 4.6 定价维持 $2/$6
不足
- •⚠️ 无官方 model card、基准套件、上下文窗口与定价页,能力数据全部来自创始人陈述
- •xAI 文档库(docs.x.ai)截至发布当周仍只列到 grok-4.6,无可用 API model ID
- •马斯克自述多模态表现仍需改进;RL 阶段过度惩罚响应长度导致过早放弃困难任务
- •国内无官方 API,需经第三方网关或代理,稳定性与合规性自负
- •迭代过快(4.5→4.6→4.7 不到三个月),为单代做深度调优的投入回收周期极短
适用场景
数据可信度提示(务必先读):截至 2026-09-16,xAI 未公开 Grok 4.7 的官方 model card、上下文窗口、基准套件与 API 定价,官方模型文档最新条目仍为 grok-4.6。本卡的参数规模与能力表述来自马斯克本人在 X 的公开陈述及多家行业日报汇总,不属于官方文档口径。接入与迁移请以 xAI 官方文档为准。
概述
Grok 4.7 是 xAI 于 2026-09-12 发布的旗舰模型,参数规模 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长约 40%。
它的定位可以概括成一句话:用规模去补能力差。 前代 4.6 的独立评测基线是「AA 智能指数 61,领先 GPT-5.6 Sol,但仍落后 Claude Opus 5 与 Fable 5」——赢在单位成本,不是绝对天花板。4.7 把参数推到 2.1T,是 xAI 押注「规模即差距」的直接体现。
同期它也延续了 xAI 近期的激进节奏:4.5(7 月)→ 4.6(8 月)→ 4.7(9 月),不到三个月三次大版本迭代,4.8(2.5T)已排在紧随其后的日程上。
核心能力
工程与科学推理(官方主推)
马斯克的表述是:除服务速度略慢外,4.7 在工程与科学推理上「优于所有模型」。
配合「用 SpaceX 公司数据补充训练」这一动作,可以推断其能力建设方向是真实世界工程任务——火箭遥测、制造工艺、故障排查这类公开互联网几乎不存在的数据。
需要冷静看待的是:这类数据第三方无法验证,且其对应的航天/制造场景对绝大多数开发者的日常工作没有直接迁移价值。真正的检验标准仍是通用编程基准与 Agent 长任务表现,而这些数据目前都没有公开。
Token 效率
官方口径称 token 效率更高(以略慢的服务速度换取更高的单位 token 产出)。在没有定价的前提下,这一说法暂时无法换算成成本优势——效率提升与单价是两件事,只有定价公开后才能判断真实性价比。
上下文与多模态
- 上下文窗口:官方未公开(前代 4.6 为 500K)。
- 多模态:马斯克在发布前明确表示多模态表现仍需改进,属已知短板。
获取方式 / 定价
| 通道 | 状态 | 说明 |
|---|---|---|
| xAI 官方 API | 待核实 | 文档库最新条目仍为 grok-4.6,4.7 的 model ID 未公开 |
| 第三方聚合网关 | 需等待同步 | 通常在官方接入后同步,建议通过网关做灰度切换 |
| 国内直连 | 无官方通道 | 需经第三方网关或代理,稳定性与合规性自负 |
| 定价 | 未公开 | 前代 Grok 4.6 为 $2 / $6 每百万 token |
在官方定价与 model ID 公开之前,不建议任何生产环境迁移动作。
适合 / 不适合
适合
- 已经在用 Grok 4.6 且成本结构依赖其低价优势的团队——等 4.7 定价公开后做一次同任务对比即可,切换成本低。
- 需要公开参数量最大档位做对比实验的研究/评测场景。
- 把 Grok 作为多模型路由中的规模档,与 Claude Fable 5.1、GPT-6 Astra 并行跑分。
不适合
- 需要 SLA 与可预期成本的生产环境——定价、限流、上下文三项都未公开,无法做容量规划。
- 强依赖多模态的场景——官方自述仍需改进。
- 长程高难度 Agent 任务——马斯克自述 RL 阶段过度惩罚响应长度,导致模型「过早放弃它本可以完成的困难任务」,而这恰恰是 Agent 最关键的指标。
- 国内合规要求严格的团队——无官方 API 通道。
与前代怎么选
| 维度 | Grok 4.6 | Grok 4.7 |
|---|---|---|
| 参数规模 | 1.5 万亿 | 2.1 万亿(+40%) |
| 官方定价 | $2 / $6 | 未公开 |
| 上下文窗口 | 500K | 未公开 |
| 官方 model card | 有 | 无 |
| API model ID | grok-4.6 | 未公开 |
| 独立第三方评测 | 有(AA 指数 61) | 未见 |
结论:现阶段继续用 4.6。 4.7 的所有关键采购信息(定价、上下文、限流)都还缺位,且官方自述存在已知短板;等官方文档更新后再评估,代价远小于提前迁移。
相关阅读
- 模型卡:Grok 4.6 · Grok 4.5 · GPT-6 Astra · Claude Fable 5.1 · DeepSeek V4.1-Flash
- 工具卡:Cursor · OpenRouter
- 概念:MoE · 推理模型 · 长上下文 · BYOK
- 相关资讯:Grok 4.7 发布:2.1 万亿参数如期上线,但官方 model card 仍然缺席 · AI 编程周报 2026-09-16
来源
- 大模型训练进入十万卡时代 三巨头为何集体"踩刹车"? — 央广网
- AI Roundup (Sat Sep 12) — DEV Community
- Musk teases AGI with Grok 5 even as 4.7 trails Anthropic and OpenAI's newest models — Cryptopolitan
本卡片由 AI 之家 编辑部根据公开资料整理,非厂商付费内容。Grok 4.7 的官方 model card、基准、上下文窗口与定价截至 2026-09-16 尚未公开,参数与能力口径来自 xAI 创始人公开陈述;一切规格以 xAI 官方文档为准,欢迎在 反馈邮箱 反馈更新。
相关工具
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。
Cursor vs Kiro:「对话式改代码」与「规格驱动开发」怎么选(2026)
Cursor 代表对话式、迭代式的 AI 编码;Kiro 主打 spec-driven,先写需求与设计文档再生成代码。一句话结论 + 决策树 + 价格对比:要速度与手感选 Cursor,要过程可控与可追溯选 Kiro。
Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比
Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。