Grok 4.5
xAI 2026 年 7 月 8 日发布的 Grok 4.5,1.5T MoE、最高 500K 上下文,用 Cursor 会话数据联合训练。定价 $2/$6 约为同级一半,主打编程性价比。
发布 2026-07-20更新 2026-07-20规格
- 厂商
- xAI
- 发布日期
- 2026/7/8
- 类型
- coding
- 上下文窗口
- 500K tokens
- 最大输出
- 64K tokens
- 定价
- 标准 $2/$6 · fast $4/$18
- API 兼容
- openai, xai
基准测试
✓ 优势
- •定价 $2/$6,约为 Opus/Sol 级模型的一半,性价比突出
- •用数万亿 token 的 Cursor 会话数据联合训练,编程与 Agent 强
- •1.5T MoE,最高 500K 上下文,支持视觉
- •80 TPS 输出,同任务 token 消耗约为同级一半
- •DeepSWE Bench 1.0 上超过 Opus 4.8
⚠ 不足
- •绝对能力天花板低于 Sol / Fable 5(赢在单位成本非峰值)
- •国内无官方 API
- •500K 上下文低于 GPT-5.6 的 1.1M(百万版本预告中)
- •生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟
适用场景
概述
Grok 4.5 是 xAI 于 2026 年 7 月 8 日发布的新一代模型,也是 SpaceX 收购 Cursor 后的首个联合技术落地。它基于 V9 底座的 1.5T MoE(较 Grok 4.3 提升约 3 倍),最高 500K 上下文(可配置),支持视觉。最大特点是用数万亿 token 的 Cursor 会话数据联合训练,主攻编程与 Agent 场景。
它的核心卖点不是「跑分最高」,而是性价比:定价 $2/$6,约为 Opus/Sol 级模型的一半,输出 80 TPS,同任务 token 消耗约为同级前沿模型的一半。
核心能力
性价比是主线
马斯克的原话:「性能还没到(别尬吹),但其实大多数任务并不需要那么高的性能。」这句话精准点出 2026 年的行业现实——当 Agent 任务的 token 账单成为企业采用 AI 的最大阻力时,「够用且便宜」比「最强」更有市场。
| 模型 | Input | Output |
|---|---|---|
| Grok 4.5 | $2 | $6 |
| GPT-5.6 Sol | $5 | $30 |
| Claude Opus 4.7 | $5 | $25 |
成本实测参考
据 Artificial Analysis 编程智能体指数,Grok 4.5 每项任务成本约 $2.49,对比 Codex 中 GPT-5.5 的 $5.07、Claude Code 中 Fable 5 的 $11.80,成本优势显著。但同一指数也显示,其绝对能力低于 Claude Code 中的 Fable 5,与 Codex 中 GPT-5.5 大致持平。一句话:赢在单位成本,而非绝对能力天花板。
不止编程
Grok 4.5 还能按自然语言构建多表关联 + 网络抓取的 Excel 模型、在 PPT 里原生绘制形状图表、写结构化 Word 文档,应用延伸到法律与金融服务。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")
resp = client.chat.completions.create(
model="grok-4.5",
messages=[{"role": "user", "content": "重构这段代码并加错误处理"}],
)
print(resp.choices[0].message.content)
定价
| 项目 | 标准 | fast |
|---|---|---|
| Input | $2/M | $4/M |
| Output | $6/M | $18/M |
标准档已能满足多数编程需求;fast 档用于对延迟敏感的交互式场景。
与同档模型怎么选
| 维度 | Grok 4.5 | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|
| 单价 | $2/$6 | $2/$10(促销) | $2.50/$15 |
| 上下文 | 500K | 1M | 1.1M |
| 能力定位 | 约等 Opus 4.7 | SWE-bench 85.2% | 强 |
| Cursor 集成 | 原生默认 | 支持 | 支持 |
| 国内可用 | ❌ | ❌ | ❌ |
建议:成本敏感、任务以工程为主、且用 Cursor 的团队,Grok 4.5 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5 或 GPT-5.6。
避坑清单
- 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
- 能力有天花板:刁钻的复杂推理任务,Grok 4.5 不如 Sol/Fable 5,别硬上。
- 500K 上下文:百万上下文版本已预告但未 GA,超大 codebase 暂需分片。
- 国内无直连:走 xAI 控制台海外账号或中转。
FAQ
Q: Grok 4.5 适合什么团队? A: 成本敏感、任务以工程编码为主、已在用 Cursor 的团队。它把「够用的能力」做到了同级一半的价格,是控制 Agent token 账单的利器。但对能力天花板要求极高的复杂任务,仍建议用 Sol/Opus 兜底。
Q: 它和 Cursor 是什么关系? A: Grok 4.5 用数万亿 token 的 Cursor 会话数据训练,7-08 经 Cursor 发布,是 SpaceX 收购 Cursor 后的首个联合成果。它给了 Cursor 一个「自家便宜模型」的默认选项,降低对 Anthropic/OpenAI 的依赖。
Q: 上下文会扩到百万吗? A: 马斯克已预告下周百万上下文版、月底 2T 参数版。当前 GA 版本最高 500K。
延伸阅读
- 对比同档:Claude Sonnet 5 / GPT-5.6 / DeepSeek V4
- 配套工具:Cursor
- 相关资讯:Grok 4.5 发布 / SpaceX 收购 Cursor