Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber(2026-09-02):同价提速,安全特化版面向受信防御方
2026-09-12 · Google Gemini API 官方 changelog(2026-09)+ 模型卡与第三方报道整合
要点
- 发布时间:2026-09-02,Gemini 3.8 Flash 与特化版 Gemini 3.8 Flash Cyber 同步发布。
- 定位:Google 自评「迄今最强推理与编程 Flash 模型」,是 coding / reasoning / agentic 工作流的「主力(workhorse)」档;六周内第三个 Flash 版本,同价提速不涨价。
- 定价:促销价 $0.75 输入 / $3.75 输出 每百万 token(锁至 2026-12-31,之后 $1.50/$7.50),与 Gemini 3.7 Flash 持平。
- Flash Cyber:专注漏洞发现与自动化补丁,仅通过 Fairwind 计划 面向受信防御方,不做广泛公开放量;CyberGym 达 86.2%,20 语言真实漏洞发现率超 70%。
- 规格:1,048,576 上下文;「更用力(try harder)」设计 + 可调 effort 档位,性能与成本按任务伸缩。
本文为 AI 之家 基于 Google Gemini API 官方 changelog、模型卡与公开报道整合;基准以 Gemini 3.8 Flash 模型卡 为准。
背景与分析
Google 在 9 月第一周的策略是 「性价比 + 安全特化」双线:3.8 Flash 用平价承接高并发 agent 工作流与长程软件工程(DeepSWE v1.1 上以零头成本超过多数更大旗舰),而 3.8 Flash Cyber 把同一架构的安全能力单独抽出来,只给有资质的防御方——和 Anthropic 把 Mythos 5.1 收在受邀门槛后的思路如出一辙。
值得注意的是「更用力」设计的代价:它意味着更耗 token,官方对效率优先场景仍建议继续用 3.7 Flash。也就是说,Flash 家族内部也出现了 按需选档 的精细化分层,而非一味推新弃旧。
对生态的连锁反应
- 与同周旗舰错位:GPT-6 Astra($10/$50)与 Claude Fable 5.1($10/$50 + 缓存 $0.25)走旗舰高价,Gemini 3.8 Flash 用 $0.75/$3.75 促销价 守住「跑量档」,三家的价格梯度在 9 月第一周同时定型。
- GitHub 模型退役联动:GitHub 预告 10-2 起 Gemini 3.5/3.6 Flash 并入 3.8 Flash(见 AI 编程周报 2026-09-12),使用 Copilot 固定模型名的团队需提前排查。
- 安全能力进入模型层:Flash Cyber 与 Astra 的「Critical」网络安全阈值、Mythos 5.1 的生命科学门槛共同指向一个趋势——前沿模型的安全能力正被拆成受控子模型,而不是全量开放。
AI 之家 观点
Gemini 3.8 Flash 的价值在于把「旗舰级推理」压到 Flash 价位,对成本敏感的高并发 agent 流水线尤其友好;但硬核终端编码仍是短板(Terminal-Bench 4.0 仅 19.1%,OpenAI 对比口径),选模型时别被「最强 Flash」的宣传带偏——看任务类型。
更值得长期关注的是 Flash Cyber 这类「安全特化子模型」的常态化。当漏洞挖掘能力既强大又危险,厂商把它收在 Fairwind 这类受信计划里,是合规与能力的折中。对企业安全团队,这是利好;对独立研究者,则意味着部分能力更难触达。9 月这波发布反复印证:2026 下半年的模型竞争,安全治理已经和性能、价格并列成为第三战场。
相关阅读
- 模型卡:Gemini 3.8 Flash / Flash Cyber
- 同周发布:GPT-6 Astra · Claude Fable 5.1
- 工具落地:Gemini CLI · Antigravity
- 编程工具周报:2026-09-12 AI 编程周报