跳到主内容

Google 发布 Gemini 3 并推出 agent 开发平台 Antigravity

Gemini 3 Pro 以 1501 Elo 登顶 LMArena,1M 上下文 + 全模态;同步发布 agent-first 开发平台 Google Antigravity,让 agent 直接驱动编辑器、终端和浏览器。

2026-06-28 · Google

发布 2026-06-28

要点

  • Gemini 3 Pro 登顶 LMArena:发布即以 1501 Elo 排名第一,被定位为 Google「最智能的模型」
  • 1M 上下文 + 全模态:原生理解文本/图片/音频/视频/代码
  • 推理大幅跃升:GPQA Diamond 91.9%,Deep Think 模式进一步推到 93.8%
  • vibe coding 标杆:WebDev Arena 1487 Elo,零样本生成交互式 Web UI
  • 同步发布 Google Antigravity:agent-first 开发平台,agent 可直接操作编辑器、终端、浏览器

事件时间:2025 年 11 月 18 日。本文为 AI 之家 收录整理。

Gemini 3 Pro:全面跃升

相比 Gemini 2.5 Pro,Gemini 3 Pro 在推理、多模态和 agentic 能力上全面升级:

基准Gemini 3 Pro说明
LMArena1501 Elo发布时登顶
GPQA Diamond91.9%博士级科学推理
Humanity's Last Exam37.5%无工具
SWE-bench Verified76.2%纯编程
Terminal-Bench 2.054.2%终端操作
WebDev Arena1487 Elo前端生成

模型规格、定价与避坑详见 Gemini 3 Pro 模型卡。

Google Antigravity:从「工具」到「主动伙伴」

Antigravity 是 Google 同步发布的 agent-first 开发平台,核心理念是把 AI 从「工具」变成「主动伙伴」:

  • agent 拥有对编辑器、终端、浏览器的直接访问权
  • 可自主规划、执行、验证端到端的软件任务
  • 集成三个模型:Gemini 3 Pro(主力)、Gemini 2.5 Computer Use(浏览器控制)、Nano Banana(图像编辑)

这是大厂首个旗舰级 agentic IDE,与 Cursor 2.0、GitHub Agent HQ 等共同把「agent 编排」推向 2026 年的主流形态。

长程 Agent 能力

Gemini 3 Pro 在 Vending-Bench 2(模拟经营一家自动售货机生意一整年)上登顶,证明能维持长周期目标不漂移。配合 Gemini Agent,可处理预订本地服务、整理 Gmail 收件箱等多步工作流。

AI 之家 观点

Gemini 3 的发布把模型竞争重新拉回「Google 也在第一梯队」的格局——尤其多模态 + 超长上下文 + vibe coding 这个组合,是它区别于 Claude Opus 4.5(最强纯编程 agent)的差异点。Antigravity 则标志着 IDE 形态从「补全/对话」彻底转向「agent 编排」。

国内开发者注意:Gemini 3 无官方直连,需 Vertex AI 或中转。

后续(2026-09-25 注记)

本文记录的是 2025-11-18 Gemini 3 与 Antigravity 发布这一历史节点。此后十个月,两条线各自走得很远,读旧文时容易低估现状:

  • Gemini 模型线:主版本已从 3 Pro 迭代到 3.8 世代,站内已收录 Gemini 3.8 Flash 与 Gemini 3.8 Live 两张卡;中间还有 Gemini 3.7 Flash(2026-08-12,$0.75/$3.75 促销价锁至 2026-12-31)。文中「1501 Elo 登顶」是发布当时的快照,不适用于判断当前排位。
  • Antigravity:已从「同期发布的平台」变成一条独立产品线,本站有独立工具卡 Antigravity。
  • 一个需要更新的引用:文中「Claude Opus 4.5 是最强纯编程 agent」是当时的对比口径。截至 2026-09,Anthropic 的编程旗舰已换为 Claude Opus 5.5(Terminal-Bench 4.0 66.4%),选型对比请以后者为准。
  • 另一个仍在生效的提醒:Gemini 系列国内无官方直连,仍需 Vertex AI 或中转。

时效性说明:资讯类内容保留原样,此处仅补注记,不改写原文结论。

相关阅读

来源

相关对比

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Gemini CLI:终端 AI Agent 怎么选?(2026 选型指南)

Claude Code 和 Gemini CLI 都是终端原生的 AI 编码 Agent。一句话结论 + 决策树 + 价格 + 国内可用性对比:长任务与 CLAUDE.md 生态选前者,免费额度与接入门槛选后者。

Codex CLI vs Crush:OpenAI 官方 vs 多模型 TUI(2026 实测选型)

Codex CLI vs Crush 2026 选型对比:OpenAI 官方终端 Coding Agent(GPT-5.6 + Windows 原生沙箱 + Apache-2.0)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、平台、生态、价格、国内可用性帮你选对终端 AI 编程工具。

Codex CLI vs Gemini CLI:两家大厂终端 Agent 怎么选?(2026 选型)

OpenAI Codex CLI 与 Google Gemini CLI 的正面比较:一句话结论 + 决策树 + 价格 + 国内可用性。已有 ChatGPT 账号选 Codex,想零成本起步选 Gemini CLI。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

相关评测