跳到主内容
AIHO 2026 全新改版上线
codingxAI

Grok 4.5

xAI 2026 年 7 月 8 日发布的 Grok 4.5,1.5T MoE、最高 500K 上下文,用 Cursor 会话数据联合训练。定价 $2/$6 约为同级一半,主打编程性价比。

发布 2026-07-20更新 2026-07-20

规格

厂商
xAI
发布日期
2026/7/8
类型
coding
上下文窗口
500K tokens
最大输出
64K tokens
定价
标准 $2/$6 · fast $4/$18
API 兼容
openai, xai

基准测试

超过 Opus 4.8
DeepSWE Bench 1.0
约 $2.49
AA 编程智能体单任务成本
约等 Opus 4.7
能力定位

✓ 优势

  • 定价 $2/$6,约为 Opus/Sol 级模型的一半,性价比突出
  • 用数万亿 token 的 Cursor 会话数据联合训练,编程与 Agent 强
  • 1.5T MoE,最高 500K 上下文,支持视觉
  • 80 TPS 输出,同任务 token 消耗约为同级一半
  • DeepSWE Bench 1.0 上超过 Opus 4.8

⚠ 不足

  • 绝对能力天花板低于 Sol / Fable 5(赢在单位成本非峰值)
  • 国内无官方 API
  • 500K 上下文低于 GPT-5.6 的 1.1M(百万版本预告中)
  • 生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟

适用场景

成本敏感的工程编码任务Cursor 内的默认低价模型高频 Agent 调用(单位成本优先)Excel 建模 / 文档生成等办公场景

概述

Grok 4.5 是 xAI 于 2026 年 7 月 8 日发布的新一代模型,也是 SpaceX 收购 Cursor 后的首个联合技术落地。它基于 V9 底座的 1.5T MoE(较 Grok 4.3 提升约 3 倍),最高 500K 上下文(可配置),支持视觉。最大特点是用数万亿 token 的 Cursor 会话数据联合训练,主攻编程与 Agent 场景。

它的核心卖点不是「跑分最高」,而是性价比:定价 $2/$6,约为 Opus/Sol 级模型的一半,输出 80 TPS,同任务 token 消耗约为同级前沿模型的一半。

核心能力

性价比是主线

马斯克的原话:「性能还没到(别尬吹),但其实大多数任务并不需要那么高的性能。」这句话精准点出 2026 年的行业现实——当 Agent 任务的 token 账单成为企业采用 AI 的最大阻力时,「够用且便宜」比「最强」更有市场。

模型InputOutput
Grok 4.5$2$6
GPT-5.6 Sol$5$30
Claude Opus 4.7$5$25

成本实测参考

据 Artificial Analysis 编程智能体指数,Grok 4.5 每项任务成本约 $2.49,对比 Codex 中 GPT-5.5 的 $5.07、Claude Code 中 Fable 5 的 $11.80,成本优势显著。但同一指数也显示,其绝对能力低于 Claude Code 中的 Fable 5,与 Codex 中 GPT-5.5 大致持平。一句话:赢在单位成本,而非绝对能力天花板。

不止编程

Grok 4.5 还能按自然语言构建多表关联 + 网络抓取的 Excel 模型、在 PPT 里原生绘制形状图表、写结构化 Word 文档,应用延伸到法律与金融服务。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")

resp = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "重构这段代码并加错误处理"}],
)
print(resp.choices[0].message.content)

定价

项目标准fast
Input$2/M$4/M
Output$6/M$18/M

标准档已能满足多数编程需求;fast 档用于对延迟敏感的交互式场景。

与同档模型怎么选

维度Grok 4.5Claude Sonnet 5GPT-5.6 Terra
单价$2/$6$2/$10(促销)$2.50/$15
上下文500K1M1.1M
能力定位约等 Opus 4.7SWE-bench 85.2%
Cursor 集成原生默认支持支持
国内可用

建议:成本敏感、任务以工程为主、且用 Cursor 的团队,Grok 4.5 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5GPT-5.6

避坑清单

  • 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
  • 能力有天花板:刁钻的复杂推理任务,Grok 4.5 不如 Sol/Fable 5,别硬上。
  • 500K 上下文:百万上下文版本已预告但未 GA,超大 codebase 暂需分片。
  • 国内无直连:走 xAI 控制台海外账号或中转。

FAQ

Q: Grok 4.5 适合什么团队? A: 成本敏感、任务以工程编码为主、已在用 Cursor 的团队。它把「够用的能力」做到了同级一半的价格,是控制 Agent token 账单的利器。但对能力天花板要求极高的复杂任务,仍建议用 Sol/Opus 兜底。

Q: 它和 Cursor 是什么关系? A: Grok 4.5 用数万亿 token 的 Cursor 会话数据训练,7-08 经 Cursor 发布,是 SpaceX 收购 Cursor 后的首个联合成果。它给了 Cursor 一个「自家便宜模型」的默认选项,降低对 Anthropic/OpenAI 的依赖。

Q: 上下文会扩到百万吗? A: 马斯克已预告下周百万上下文版、月底 2T 参数版。当前 GA 版本最高 500K。

延伸阅读

相关工具