跳到主内容
codingxAI

Grok 4.5

xAI 2026 年 7 月 8 日发布的 Grok 4.5,1.5T MoE、最高 500K 上下文,用 Cursor 会话数据联合训练。定价 $2/$6 约为同级一半,主打编程性价比。

发布 2026-07-20更新 2026-08-15

规格

厂商
xAI
发布日期
2026/7/8
类型
coding
上下文窗口
500K tokens
最大输出
64K tokens
定价
标准 $2/$6 · fast $4/$18
API 兼容
openai, xai

基准测试

超过 Opus 4.8
DeepSWE Bench 1.0
约 $2.49
AA 编程智能体单任务成本
约等 Opus 4.7
能力定位

优势

  • 定价 $2/$6,约为 Opus/Sol 级模型的一半,性价比突出
  • 用数万亿 token 的 Cursor 会话数据联合训练,编程与 Agent 强
  • 1.5T MoE,最高 500K 上下文,支持视觉
  • 80 TPS 输出,同任务 token 消耗约为同级一半
  • DeepSWE Bench 1.0 上超过 Opus 4.8

不足

  • 绝对能力天花板低于 Sol / Fable 5(赢在单位成本非峰值)
  • 国内无官方 API
  • 500K 上下文低于 GPT-5.6 的 1.1M(百万版本预告中)
  • 生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟

适用场景

成本敏感的工程编码任务Cursor 内的默认低价模型高频 Agent 调用(单位成本优先)Excel 建模 / 文档生成等办公场景

概述

Grok 4.5 是 xAI 于 2026 年 7 月 8 日发布的新一代模型,也是 SpaceX 收购 Cursor 后的首个联合技术落地。它基于 V9 底座的 1.5T MoE(较 Grok 4.3 提升约 3 倍),最高 500K 上下文(可配置),支持视觉。最大特点是用数万亿 token 的 Cursor 会话数据联合训练,主攻编程与 Agent 场景。

2026-08 更新:同档已发布 Grok 4.6——经 agentic RL 训练,AA 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6,并配套 Grok Bot 自主 Agent。日常编码仍可用 4.5,长任务/Agent 场景建议升级 4.6。

它的核心卖点不是「跑分最高」,而是性价比:定价 $2/$6,约为 Opus/Sol 级模型的一半,输出 80 TPS,同任务 token 消耗约为同级前沿模型的一半。

核心能力

性价比是主线

马斯克的原话:「性能还没到(别尬吹),但其实大多数任务并不需要那么高的性能。」这句话精准点出 2026 年的行业现实——当 Agent 任务的 token 账单成为企业采用 AI 的最大阻力时,「够用且便宜」比「最强」更有市场。

模型InputOutput
Grok 4.5$2$6
GPT-5.6 Sol$5$30
Claude Opus 4.7$5$25

成本实测参考

据 Artificial Analysis 编程智能体指数,Grok 4.5 每项任务成本约 $2.49,对比 Codex 中 GPT-5.5 的 $5.07、Claude Code 中 Fable 5 的 $11.80,成本优势显著。但同一指数也显示,其绝对能力低于 Claude Code 中的 Fable 5,与 Codex 中 GPT-5.5 大致持平。一句话:赢在单位成本,而非绝对能力天花板。

不止编程

Grok 4.5 还能按自然语言构建多表关联 + 网络抓取的 Excel 模型、在 PPT 里原生绘制形状图表、写结构化 Word 文档,应用延伸到法律与金融服务。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")

resp = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "重构这段代码并加错误处理"}],
)
print(resp.choices[0].message.content)

定价

项目标准fast
Input$2/M$4/M
Output$6/M$18/M

标准档已能满足多数编程需求;fast 档用于对延迟敏感的交互式场景。

与同档模型怎么选

维度Grok 4.5Claude Sonnet 5GPT-5.6 Terra
单价$2/$6$2/$10(促销)$2.50/$15
上下文500K1M1.1M
能力定位约等 Opus 4.7SWE-bench 85.2%
Cursor 集成原生默认支持支持
国内可用

建议:成本敏感、任务以工程为主、且用 Cursor 的团队,Grok 4.5 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5GPT-5.6

避坑清单

  • 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
  • 能力有天花板:刁钻的复杂推理任务,Grok 4.5 不如 Sol/Fable 5,别硬上。
  • 500K 上下文:百万上下文版本已预告但未 GA,超大 codebase 暂需分片。
  • 国内无直连:走 xAI 控制台海外账号或中转。

FAQ

Q: Grok 4.5 适合什么团队? A: 成本敏感、任务以工程编码为主、已在用 Cursor 的团队。它把「够用的能力」做到了同级一半的价格,是控制 Agent token 账单的利器。但对能力天花板要求极高的复杂任务,仍建议用 Sol/Opus 兜底。

Q: 它和 Cursor 是什么关系? A: Grok 4.5 用数万亿 token 的 Cursor 会话数据训练,7-08 经 Cursor 发布,是 SpaceX 收购 Cursor 后的首个联合成果。它给了 Cursor 一个「自家便宜模型」的默认选项,降低对 Anthropic/OpenAI 的依赖。

Q: 上下文会扩到百万吗? A: 马斯克已预告下周百万上下文版、月底 2T 参数版。当前 GA 版本最高 500K。

延伸阅读

相关工具

相关对比

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比

Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。

Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比

Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。

Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?

Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。