Grok 4.5
xAI 2026 年 7 月 8 日发布的 Grok 4.5,1.5T MoE、最高 500K 上下文,用 Cursor 会话数据联合训练。定价 $2/$6 约为同级一半,主打编程性价比。
发布 2026-07-20更新 2026-08-15规格
- 厂商
- xAI
- 发布日期
- 2026/7/8
- 类型
- coding
- 上下文窗口
- 500K tokens
- 最大输出
- 64K tokens
- 定价
- 标准 $2/$6 · fast $4/$18
- API 兼容
- openai, xai
基准测试
优势
- •定价 $2/$6,约为 Opus/Sol 级模型的一半,性价比突出
- •用数万亿 token 的 Cursor 会话数据联合训练,编程与 Agent 强
- •1.5T MoE,最高 500K 上下文,支持视觉
- •80 TPS 输出,同任务 token 消耗约为同级一半
- •DeepSWE Bench 1.0 上超过 Opus 4.8
不足
- •绝对能力天花板低于 Sol / Fable 5(赢在单位成本非峰值)
- •国内无官方 API
- •500K 上下文低于 GPT-5.6 的 1.1M(百万版本预告中)
- •生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟
适用场景
概述
Grok 4.5 是 xAI 于 2026 年 7 月 8 日发布的新一代模型,也是 SpaceX 收购 Cursor 后的首个联合技术落地。它基于 V9 底座的 1.5T MoE(较 Grok 4.3 提升约 3 倍),最高 500K 上下文(可配置),支持视觉。最大特点是用数万亿 token 的 Cursor 会话数据联合训练,主攻编程与 Agent 场景。
2026-08 更新:同档已发布 Grok 4.6——经 agentic RL 训练,AA 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6,并配套 Grok Bot 自主 Agent。日常编码仍可用 4.5,长任务/Agent 场景建议升级 4.6。
它的核心卖点不是「跑分最高」,而是性价比:定价 $2/$6,约为 Opus/Sol 级模型的一半,输出 80 TPS,同任务 token 消耗约为同级前沿模型的一半。
核心能力
性价比是主线
马斯克的原话:「性能还没到(别尬吹),但其实大多数任务并不需要那么高的性能。」这句话精准点出 2026 年的行业现实——当 Agent 任务的 token 账单成为企业采用 AI 的最大阻力时,「够用且便宜」比「最强」更有市场。
| 模型 | Input | Output |
|---|---|---|
| Grok 4.5 | $2 | $6 |
| GPT-5.6 Sol | $5 | $30 |
| Claude Opus 4.7 | $5 | $25 |
成本实测参考
据 Artificial Analysis 编程智能体指数,Grok 4.5 每项任务成本约 $2.49,对比 Codex 中 GPT-5.5 的 $5.07、Claude Code 中 Fable 5 的 $11.80,成本优势显著。但同一指数也显示,其绝对能力低于 Claude Code 中的 Fable 5,与 Codex 中 GPT-5.5 大致持平。一句话:赢在单位成本,而非绝对能力天花板。
不止编程
Grok 4.5 还能按自然语言构建多表关联 + 网络抓取的 Excel 模型、在 PPT 里原生绘制形状图表、写结构化 Word 文档,应用延伸到法律与金融服务。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")
resp = client.chat.completions.create(
model="grok-4.5",
messages=[{"role": "user", "content": "重构这段代码并加错误处理"}],
)
print(resp.choices[0].message.content)
定价
| 项目 | 标准 | fast |
|---|---|---|
| Input | $2/M | $4/M |
| Output | $6/M | $18/M |
标准档已能满足多数编程需求;fast 档用于对延迟敏感的交互式场景。
与同档模型怎么选
| 维度 | Grok 4.5 | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|
| 单价 | $2/$6 | $2/$10(促销) | $2.50/$15 |
| 上下文 | 500K | 1M | 1.1M |
| 能力定位 | 约等 Opus 4.7 | SWE-bench 85.2% | 强 |
| Cursor 集成 | 原生默认 | 支持 | 支持 |
| 国内可用 |
建议:成本敏感、任务以工程为主、且用 Cursor 的团队,Grok 4.5 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5 或 GPT-5.6。
避坑清单
- 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
- 能力有天花板:刁钻的复杂推理任务,Grok 4.5 不如 Sol/Fable 5,别硬上。
- 500K 上下文:百万上下文版本已预告但未 GA,超大 codebase 暂需分片。
- 国内无直连:走 xAI 控制台海外账号或中转。
FAQ
Q: Grok 4.5 适合什么团队? A: 成本敏感、任务以工程编码为主、已在用 Cursor 的团队。它把「够用的能力」做到了同级一半的价格,是控制 Agent token 账单的利器。但对能力天花板要求极高的复杂任务,仍建议用 Sol/Opus 兜底。
Q: 它和 Cursor 是什么关系? A: Grok 4.5 用数万亿 token 的 Cursor 会话数据训练,7-08 经 Cursor 发布,是 SpaceX 收购 Cursor 后的首个联合成果。它给了 Cursor 一个「自家便宜模型」的默认选项,降低对 Anthropic/OpenAI 的依赖。
Q: 上下文会扩到百万吗? A: 马斯克已预告下周百万上下文版、月底 2T 参数版。当前 GA 版本最高 500K。
延伸阅读
- 同档升级:Grok 4.6(agentic RL,推荐新项目)
- 对比同档:Claude Sonnet 5 / GPT-5.6 / DeepSeek V4
- 配套工具:Cursor
- 相关资讯:Grok 4.5 发布 / Grok 4.6 发布 / SpaceX 收购 Cursor
相关工具
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。
Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比
Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。
Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?
Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。