跳到主内容
codingxAI

Grok 4.6

xAI 2026 年 8 月发布的 Grok 4.6,经 agentic RL 训练,AA 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6。配套 Grok Bot——拥有独立电脑、可端到端自主完成任务的 AI 队友。

发布 2026-08-15更新 2026-08-15

规格

厂商
xAI
发布日期
2026/8/11
类型
coding
上下文窗口
500K tokens
最大输出
64K tokens
定价
$2 / $6(与 4.5 同价)
API 兼容
openai, xai

基准测试

61(追平 GPT-5.6 Sol)
Artificial Analysis 智能指数
约等 GPT-5.6 Sol(单位成本更优)
能力定位

优势

  • 经 agentic RL 训练,AA 智能指数 61,追平 GPT-5.6 Sol
  • 定价维持 $2/$6,性价比延续 4.5 的优势
  • 首日登陆 Cursor 与 Grok Build 分发
  • 配套 Grok Bot:拥有独立电脑的 AI 队友,端到端自主完成任务
  • 1.5T MoE,最高 500K 上下文,支持视觉

不足

  • 绝对能力天花板仍低于 Sol / Fable 5(赢在单位成本)
  • 国内无官方 API
  • 500K 上下文低于 GPT-5.6 的 1.1M
  • 生态较新,第三方工具集成不如 OpenAI/Anthropic 成熟

适用场景

成本敏感的工程编码与 Agent 任务Cursor 内的默认低价模型高频 Agent 调用(单位成本优先)Grok Bot 式自主长任务(登录工具、跨 inbox 作业)

概述

Grok 4.6 是 xAI 于 2026 年 8 月发布的新一代模型,最大变化是用 agentic RL(智能体强化学习)训练——不再是单纯堆参数的聊天模型,而是为「在多步 Agent 环路里干活」专门打磨。它在 Artificial Analysis 智能指数上拿到 61,追平 OpenAI 的 GPT-5.6 Sol,而定价维持 $2/$6 不变,性价比延续了 4.5 的路线。

与 4.6 同期,xAI 还推出了 Grok Bot——一种「拥有自己电脑的 AI 队友」:能登录用户的工具与应用、跨收件箱工作、端到端自主完成任务,已对公众开放。

上代对照:Grok 4.5(4.5 用 Cursor 会话数据联合训练,4.6 进一步用 agentic RL 强化自主能力)。

核心能力

agentic RL 带来的质变

4.5 的卖点是「用 Cursor 会话数据联合训练,够用且便宜」;4.6 的卖点升级为「用 agentic RL 训练,能在多步任务里自我纠错、持续推进」。这在 AA 智能指数上体现明显——61 分追平 GPT-5.6 Sol,但单价只有 Sol 的几分之一。

性价比仍是主线

模型InputOutputAA 智能指数
Grok 4.6$2$661
GPT-5.6 Sol$5$3061
Claude Opus 4.7$5$25

一句话:赢在单位成本,而非绝对能力天花板——适合把「够用的能力」铺到大规模 Agent 调用上。

Grok Bot:从模型到自主 Agent

Grok Bot 把 4.6 的能力包装成可直接雇佣的「数字员工」:

  • 拥有独立的运行环境(自己的电脑)
  • 登录用户的工具与应用(邮箱、日历、SaaS);
  • 跨收件箱/workflow 端到端自主完成任务,而非只回一段文字;
  • 已向公众开放,是 xAI 从「模型供应商」迈向「Agent 产品」的信号。

分发与接入

  • 首日登陆 Cursor 与 Grok Build,延续 4.5 与 Cursor 的深度绑定;
  • API 兼容 OpenAI 格式(base_url=https://api.x.ai/v1);
  • 1.5T MoE,最高 500K 上下文,支持视觉。

API 调用示例

from openai import OpenAI
client = OpenAI(api_key="xai-...", base_url="https://api.x.ai/v1")

resp = client.chat.completions.create(
    model="grok-4.6",
    messages=[{"role": "user", "content": "重构这段代码并加错误处理,跑测试确认通过"}],
)
print(resp.choices[0].message.content)

与同档模型怎么选

维度Grok 4.6Claude Sonnet 5GPT-5.6 Terra
单价$2/$6$2/$10(促销)$2.50/$15
AA 智能指数61(= Sol)Sol 61
上下文500K1M1.1M
自主 Agent 产品Grok BotClaude CoworkChatGPT Work
国内可用

建议:成本敏感、任务以工程/Agent 为主、且用 Cursor 的团队,Grok 4.6 是极佳的默认低价选项;要更高绝对能力选 Sonnet 5GPT-5.6。想要「开箱即用的自主数字员工」可试 Grok Bot。

避坑清单

  • 基准分不等于你项目的表现:大规模采用前务必用自己的代码库实测。
  • 能力有天花板:刁钻的复杂推理任务,Grok 4.6 不如 Sol/Fable 5,别硬上。
  • 500K 上下文:超大 codebase 暂需分片。
  • 国内无直连:走 xAI 控制台海外账号或中转。

FAQ

Q: Grok 4.6 和 4.5 区别大吗? A: 架构与定价基本一致(都是 $2/$6、1.5T MoE),核心差异在训练方式——4.6 用 agentic RL 强化多步自主能力,AA 指数追平 GPT-5.6 Sol。日常编码体感接近,但长任务/工作流场景 4.6 更稳。

Q: Grok Bot 和 Grok 4.6 是什么关系? A: 4.6 是底层模型,Grok Bot 是跑在 4.6 之上的自主 Agent 产品——它有独立运行环境、能登录你的工具、端到端完成任务。想要模型接入自己系统用 4.6 API;想要「雇一个数字员工」用 Grok Bot。

Q: 国内怎么用? A: 官方 API 不直供国内,走 xAI 海外账号或 OpenRouter 等中转。

延伸阅读

相关工具

相关对比

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Cursor vs GitHub Copilot:AI IDE 还是插件?2026 对比

Cursor vs GitHub Copilot 2026 选型对比:AI 原生 IDE vs IDE 插件,从 Composer vs Agent Mode、Tab 补全、多模型、AI Credits 计费、企业版和适合人群判断,帮开发者选对。Cursor 是 VS Code fork 重写交互层,Copilot 是 VS Code 插件继承原生体验。两家都已切 usage 制。

Cursor vs Trae:国内开发者怎么选?价格、模型、网络和真实体验对比

Cursor vs Trae 2026 选型对比:从价格、模型能力、国内访问、Builder/Composer、多文件改写、MCP 生态和适合人群判断,帮国内开发者决定继续用 Cursor,还是切到字节 Trae。

Cursor vs v0:AI 编程 IDE vs AI 前端生成器怎么选?

Cursor vs v0 2026 选型对比:Anysphere 的 AI 原生 IDE vs Vercel 的 AI 前端组件生成器。从定位、工作流、输出物、价格、适合人群 6 个维度帮你选对工具:全栈工程选 Cursor,快速 UI 原型选 v0。