[{"data":1,"prerenderedAt":290},["ShallowReactive",2],{"header-counts":3,"footer-counts":6,"news-2026-gemini-3-6-flash-release":9},{"tools":4,"reviews":5},78,26,{"tools":4,"reviews":5,"playbooks":7,"news":8},22,27,{"id":10,"title":11,"body":12,"cover":279,"description":280,"extension":281,"lastVerified":279,"meta":282,"navigation":283,"path":284,"published":32,"seo":285,"sourceName":286,"sourceUrl":287,"stem":288,"__hash__":289},"news\u002Fnews\u002F2026\u002Fgemini-3-6-flash-release.md","Google 发布 Gemini 3.6 Flash：1M 上下文、每百万 token $1.50 起",{"type":13,"value":14,"toc":265},"minimark",[15,19,57,61,69,80,83,87,94,97,129,132,170,174,188,192,219,223,239,242],[16,17,18],"h2",{"id":18},"要点",[20,21,22,34,40,47,54],"ul",{},[23,24,25,29,30,33],"li",{},[26,27,28],"strong",{},"Gemini 3.6 Flash"," 于 ",[26,31,32],{},"2026-07-21"," 作为**稳定版（stable）**在 Gemini API 上线。",[23,35,36,39],{},[26,37,38],{},"1,048,576 token 输入上下文","，65,536 token 输出上限。",[23,41,42,43,46],{},"官方定价 ",[26,44,45],{},"$1.50 输入 \u002F $7.50 输出 \u002F $0.15 缓存输入","（每百万 token）。",[23,48,49,50,53],{},"同批上线 ",[26,51,52],{},"Gemini 3.5 Flash-Lite","（$0.30\u002F$2.50，面向超大规模自动化）。",[23,55,56],{},"接入面：Google AI Studio、Vertex AI、Gemini Developer API 均可用。",[16,58,60],{"id":59},"发布细节为什么是stable很重要","发布细节：为什么是「stable」很重要",[62,63,64,65,68],"p",{},"此前 Flash 系列常先以预览\u002F实验通道放出，版本号漂移、SLA 不稳，生产接入要自己踩坑。这次标 ",[26,66,67],{},"stable","，意味着：",[20,70,71,74,77],{},[23,72,73],{},"版本进入长期维护，行为可预期；",[23,75,76],{},"定价固化，便于做成本预算；",[23,78,79],{},"适合直接进生产，而非「先试试」。",[62,81,82],{},"对要做长期产品的团队，这是比参数本身更关键的信号。",[16,84,86],{"id":85},"flash-产品线的来龙去脉","Flash 产品线的来龙去脉",[62,88,89,90,93],{},"Google 的 Flash 档位一路从 1.5 → 2.0 → 2.5 → 3.0 → 3.5 → 现在的 3.6，主线就一条：",[26,91,92],{},"把多模态 + 长上下文打到可批量的价格","。每一代都在「更便宜 \u002F 更长上下文 \u002F 更低延迟」上推进，而不是去和 Pro 抢榜单第一。3.6 Flash 把上下文拉到 1M、输出 65K，同时保持 $1.50 的低位输入价，明显是冲着「高并发多模态 + 长上下文 RAG」场景去的。",[16,95,96],{"id":96},"技术要点拆解",[20,98,99,111,117,123],{},[23,100,101,104,105,110],{},[26,102,103],{},"1M 上下文","：可整文档\u002F整仓库直读，很多 RAG 场景能省掉向量召回链路，但长上下文单次成本更高，需按需截取（详见",[106,107,109],"a",{"href":108},"\u002Fmodels\u002Fgemini-3-6-flash.html","模型详解","）。",[23,112,113,116],{},[26,114,115],{},"$0.15 缓存输入","：把系统提示\u002F知识库前缀设为可缓存前缀，复用即享 1\u002F10 价格——这是把高并发成本真正压下来的关键开关。",[23,118,119,122],{},[26,120,121],{},"原生多模态","：图\u002F视频\u002F音频与文本统一输入，视频时序理解是相对差异化能力。",[23,124,125,128],{},[26,126,127],{},"Flash-Lite 兜底","：对质量容忍度高的超大规模跑量，再降一档到 $0.30\u002F$2.50。",[16,130,131],{"id":131},"对生态的连锁反应",[20,133,134,140,155],{},[23,135,136,139],{},[26,137,138],{},"多模态 Agent 成本下降","：图像\u002F视频\u002F音频统一输入 + 低价，让「感知型」Agent 跑量更划算。",[23,141,142,145,146,150,151,110],{},[26,143,144],{},"与 GPT-5.6 \u002F Claude 的分工更清晰","：Google 用 Flash 守成本与多模态，OpenAI\u002FAnthropic 在编程 Agent 基准上仍更常被引用（见 ",[106,147,149],{"href":148},"\u002Fmodels\u002Fgpt-5-6.html","GPT-5.6"," \u002F ",[106,152,154],{"href":153},"\u002Fmodels\u002Fclaude-sonnet-5.html","Claude Sonnet 5",[23,156,157,160,161,150,165,169],{},[26,158,159],{},"聚合层直接受益","：",[106,162,164],{"href":163},"\u002Fcoding\u002Fide\u002Fcursor.html","Cursor",[106,166,168],{"href":167},"\u002Fcoding\u002Fapi\u002Fopenrouter.html","OpenRouter"," 等多一个便宜的多模态档可选，路由分层更顺。",[16,171,173],{"id":172},"谁该关注谁可以等","谁该关注，谁可以等",[20,175,176,182],{},[23,177,178,181],{},[26,179,180],{},"该关注","：做内容审核、文档理解、多模态客服、长上下文 RAG、低成本 Agent 的团队——这是比 Pro 更友好的默认档。",[23,183,184,187],{},[26,185,186],{},"可以等","：纯编程 Agent、对 SWE-bench\u002FTerminal-Bench 成绩敏感的团队，建议等 Google 公布独立编程基准再评估。",[16,189,191],{"id":190},"上手步骤5-分钟跑通","上手步骤（5 分钟跑通）",[193,194,195,198,206,209,212],"ol",{},[23,196,197],{},"打开 Google AI Studio，创建 API Key；",[23,199,200,201,205],{},"选模型 ",[202,203,204],"code",{},"gemini-3.6-flash","；",[23,207,208],{},"先发一条文本请求验证连通；",[23,210,211],{},"把高频前缀（系统提示\u002F知识库）设为缓存，观察单价降到 $0.15；",[23,213,214,215,218],{},"接入生产前先用 ",[106,216,217],{"href":108},"模型详解里的成本公式","估一遍日活成本。",[16,220,222],{"id":221},"aiho-观点","AIHO 观点",[62,224,225,226,229,230,238],{},"Gemini 3.6 Flash 不是「最强模型」，而是「最划算的多模态工作马」之一。它的价值不在刷榜，而在把",[26,227,228],{},"长上下文 + 多模态 + 低单价","三件事同时做实。对大多数要做内容审核、文档理解、客服对话的团队，它比 Pro 更该成为默认档——",[26,231,232,233,150,235,237],{},"但涉及硬核编程 Agent，仍建议先拿 ",[106,234,149],{"href":148},[106,236,154],{"href":153}," 的公开基准比对","。",[16,240,241],{"id":241},"相关阅读",[20,243,244,249,254,259],{},[23,245,246],{},[106,247,248],{"href":108},"Gemini 3.6 Flash 模型详解",[23,250,251],{},[106,252,253],{"href":148},"GPT-5.6 模型详解",[23,255,256],{},[106,257,258],{"href":153},"Claude Sonnet 5 模型详解",[23,260,261],{},[106,262,264],{"href":263},"\u002Fmodels\u002Fgemini-3-pro.html","Gemini 3 Pro 模型详解",{"title":266,"searchDepth":267,"depth":267,"links":268},"",3,[269,271,272,273,274,275,276,277,278],{"id":18,"depth":270,"text":18},2,{"id":59,"depth":270,"text":60},{"id":85,"depth":270,"text":86},{"id":96,"depth":270,"text":96},{"id":131,"depth":270,"text":131},{"id":172,"depth":270,"text":173},{"id":190,"depth":270,"text":191},{"id":221,"depth":270,"text":222},{"id":241,"depth":270,"text":241},null,"Gemini 3.6 Flash 于 2026-07-21 在 Gemini API 稳定上线，1M 输入上下文、65K 输出，定价 $1.50\u002F$7.50，延续 Flash 系列低价低延迟多模态定位；同批还有 3.5 Flash-Lite。本文拆解技术要点、适用人群与上手方式。","md",{},true,"\u002Fnews\u002F2026\u002Fgemini-3-6-flash-release",{"title":11,"description":280},"benchr（援引 Google）","https:\u002F\u002Fbenchr.org\u002Frecent-releases","news\u002F2026\u002Fgemini-3-6-flash-release","hHZcd4K-pmg6nmKH6jmRl124bCsyr8fe2UF7DdVW1aM",1785161585884]