xAI 发布 Grok 4.6 与 Grok Bot:agentic RL 训练,AA 指数追平 GPT-5.6 Sol
xAI 于 2026-08 发布 Grok 4.6,经 agentic RL 训练,Artificial Analysis 智能指数 61 追平 GPT-5.6 Sol,定价维持 $2/$6。同期推出 Grok Bot——拥有独立电脑、可端到端自主完成任务的 AI 队友,已对公众开放。
2026-08-11 · xAI
发布 2026-08-11要点
- Grok 4.6 于 2026-08 发布,最大变化是经 agentic RL(智能体强化学习)训练,专为多步 Agent 环路打磨。
- Artificial Analysis 智能指数 61,追平 OpenAI 的 GPT-5.6 Sol;定价维持 $2/$6,性价比延续 4.5。
- 首日登陆 Cursor 与 Grok Build 分发,延续与 Cursor 的深度绑定。
- 同期推出 Grok Bot:拥有独立运行环境(自己的电脑),能登录用户的工具与应用、跨收件箱端到端自主完成任务,已对公众开放。
从「模型」到「自主 Agent 产品」
Grok 4.5 的卖点是「用 Cursor 会话数据联合训练,够用且便宜」;4.6 升级为「用 agentic RL 强化多步自主能力」。Grok Bot 则把 4.6 包装成可直接雇佣的数字员工——这是 xAI 从「模型供应商」迈向「Agent 产品」的信号,与 OpenAI 的 ChatGPT Work、Anthropic 的 Claude Cowork 形成呼应。
性价比仍是主线
| 模型 | Input | Output | AA 智能指数 |
|---|---|---|---|
| Grok 4.6 | $2 | $6 | 61 |
| GPT-5.6 Sol | $5 | $30 | 61 |
一句话:赢在单位成本,而非绝对能力天花板——适合把「够用的能力」铺到大规模 Agent 调用上。
怎么用
- 日常编程:在 Cursor 里直接切到 Grok 4.6,沿用 4.5 的工作流即可,无需改习惯。
- 大规模 Agent 调用:看重的是 $2/$6 的单位成本而非绝对天花板——把「够用的能力」铺到高频调用上,比追单点 SOTA 更划算。
- Grok Bot:适合把「跨收件箱、跨应用的重复流程」交给自主 Agent 跑,人类只做最终确认。
后续(2026-09 补记):xAI 已迭代至 Grok 4.7,详见 Grok 4.7 模型卡;本条资讯保留 4.6 发布时的原始事实,选型请以最新一档为准。
AI 之家 观点
Grok 4.6 的信号藏在「agentic RL」这四个字里:它不再追求榜单上的绝对天花板,而是把训练目标对准「多步环路里能跑完」——这和同期各家不约而同转向 coordinator / 长程任务是同一条主线。AA 指数 61 追平 GPT-5.6 Sol,但价格只有对方的约三分之一($2/$6 对 $5/$30),这才是它的真实杀手锏。
Grok Bot 则是更激进的一步:模型厂商开始直接交付「能登录你工具链的数字员工」,而不是只卖 API。这一步的风险不在能力,而在权限与审计——把收件箱和生产系统交给自主 Agent 之前,先想清楚谁能看到它的操作日志。
AI 之家 推荐结论:高频、大规模、单点容错高的 Agent 调用,Grok 4.6 这一档的单位成本优势很难被撼动;但涉及关键链路或需要绝对能力天花板,仍应把闭源旗舰留在路由表的上层。两者叠加使用,比二选一更划算。
相关阅读
来源
- xAI(2026-08-11)