Grok 4.6
xAI 2026 年 8 月发布的 Grok 4.6,经 agentic RL 训练,AA 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6。配套 Grok Bot——拥有独立电脑、可端到端自主完成任务的 AI 队友。
发布 2026-08-15更新 2026-08-15规格
- 厂商
- xAI
- 发布日期
- 2026/8/11
- 类型
- coding
- 上下文窗口
- 500K tokens
- 最大输出
- 64K tokens
- 定价
- $2 / $6(与 4.5 同价)
- API 兼容
- openai, xai
基准测试
优势
- •经 agentic RL 训练,AA 智能指数 61,追平 GPT-5.6 Sol
- •定价维持 $2/$6,性价比延续 4.5 的优势
- •首日登陆 Cursor 与 Grok Build 分发
- •配套 Grok Bot:拥有独立电脑的 AI 队友,端到端自主完成任务
- •1.5T MoE,最高 500K 上下文,支持视觉
不足
- •绝对能力天花板仍低于 Sol / Fable 5(赢在单位成本)
- •国内无官方 API
- •500K 上下文低于 GPT-5.6 的 1.1M
- •生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟
适用场景
概述
Grok 4.6 是 xAI 于 2026 年 8 月发布的新一代模型,最大变化是用 agentic RL(智能体强化学习)训练——不再是单纯堆参数的聊天模型,而是为「在多步 Agent 环路里干活」专门打磨。它在 Artificial Analysis 智能指数上拿到 61,追平 OpenAI 的 GPT-5.6 Sol,而定价维持 $2/$6 不变,性价比延续了 4.5 的路线。
与 4.6 同期,xAI 还推出了 Grok Bot——一种「拥有自己电脑的 AI 队友」:能登录用户的工具与应用、跨收件箱工作、端到端自主完成任务,已对公众开放。
上代对照:Grok 4.5(4.5 用 Cursor 会话数据联合训练,4.6 进一步用 agentic RL 强化自主能力)。
核心能力
agentic RL 带来的质变
4.5 的卖点是「用 Cursor 会话数据联合训练,够用且便宜」;4.6 的卖点升级为「用 agentic RL 训练,能在多步任务里自我纠错、持续推进」。这在 AA 智能指数上体现明显——61 分追平 GPT-5.6 Sol,但单价只有 Sol 的几分之一。
性价比仍是主线
| 模型 | Input | Output | AA 智能指数 |
|---|---|---|---|
| Grok 4.6 | $2 | $6 | 61 |
| GPT-5.6 Sol | $5 | $30 | 61 |
| Claude Opus 4.7 | $5 | $25 | — |
一句话:赢在单位成本,而非绝对能力天花板——适合把「够用的能力」铺到大规模 Agent 调用上。
Grok Bot:从模型到自主 Agent
Grok Bot 把 4.6 的能力包装成可直接雇佣的「数字员工」:
- 拥有独立的运行环境(自己的电脑);
- 能登录用户的工具与应用(邮箱、日历、SaaS);
- 跨收件箱/workflow 端到端自主完成任务,而非只回一段文字;
- 已向公众开放,是 xAI 从「模型供应商」迈向「Agent 产品」的信号。
分发与接入
- 首日登陆 Cursor 与 Grok Build,延续 4.5 与 Cursor 的深度绑定;
- API 兼容 OpenAI 格式(
base_url=https://api.x.ai/v1); - 1.5T MoE,最高 500K 上下文,支持视觉。
API 调用示例
from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")
resp = client.chat.completions.create(
model="grok-4.6",
messages=[{"role": "user", "content": "重构这段代码并加错误处理,跑测试确认通过"}],
)
print(resp.choices[0].message.content)
与同档模型怎么选
| 维度 | Grok 4.6 | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|
| 单价 | $2/$6 | $2/$10(促销) | $2.50/$15 |
| AA 智能指数 | 61(= Sol) | — | Sol 61 |
| 上下文 | 500K | 1M | 1.1M |
| 自主 Agent 产品 | Grok Bot | Claude Cowork | ChatGPT Work |
| 国内可用 |
建议:成本敏感、任务以工程/Agent 为主、且用 Cursor 的团队,Grok 4.6 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5 或 GPT-5.6。想要「开箱即用的自主数字员工」可试 Grok Bot。
避坑清单
- 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
- 能力有天花板:刁钻的复杂推理任务,Grok 4.6 不如 Sol/Fable 5,别硬上。
- 500K 上下文:超大 codebase 暂需分片。
- 国内无直连:走 xAI 控制台海外账号或中转。
FAQ
Q: Grok 4.6 和 4.5 区别大吗? A: 架构与定价基本一致(都是 $2/$6、1.5T MoE),核心差异在训练方式——4.6 用 agentic RL 强化多步自主能力,AA 指数追平 GPT-5.6 Sol。日常编码体感接近,但长任务/工作流场景 4.6 更稳。
Q: Grok Bot 和 Grok 4.6 是什么关系? A: 4.6 是底层模型,Grok Bot 是跑在 4.6 之上的自主 Agent 产品——它有独立运行环境、能登录你的工具、端到端完成任务。想要模型接入自己系统用 4.6 API;想要「雇一个数字员工」用 Grok Bot。
Q: 国内怎么用? A: 官方 API 不直供国内,走 xAI 海外账号或 OpenRouter 等中转。
延伸阅读
- 上代对比:Grok 4.5
- 同档对比:Claude Sonnet 5 / GPT-5.6 / DeepSeek V4
- 配套工具:Cursor
- 相关资讯:Grok 4.6 发布
相关工具
Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比
Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。
Cursor vs Aider:GUI IDE 还是 CLI?2026 对比
Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。
Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)
Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。
Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比
Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。
Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比
Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。
Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?
Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。