谷歌三连发 Gemini 3.6 Flash / Flash-Lite / Flash Cyber:把 Agent 成本往下砍

7 月 21 日,Google 一次性放出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。和 3.5 Pro 迟迟不露面的谨慎相比,Google 在 Flash 层级的更新节奏明显加快——三版本同天上线,目标明确:高吞吐、低延迟、可大规模复制的 Agent 工作流。 3.6 Flash 是这次的主力。按 Artificial Analysis Index,质量不降的同时输出 token 较 3.5 Flash 砍 17%,DeepSWE 最高省 65%,定价 1.50/7.50 美元每百万 token。Computer Use 作为客户端内置工具原生开放,OSWorld-Verified 从 78.4 提到 83.0。博客里直接亮出 DeepSWE 49% vs 37%、MLE Bench 63.9% vs 49.7% 等对比,卖点很清晰:质量没掉,单任务成本更低。 3.5 Flash-Lite 把"便宜大碗"做到极致:350 tokens/s 输出、0.30/2.50 美元每百万 token。对标自家上一代 3 Flash,SWE-Bench Pro(54.2% vs 49.6%)和 OSWorld-Verified(74.0% vs 65.1%)都已反超。Google 把"高 QPS、文档批量处理"这类流水线任务彻底独立成档,主力模型不必再硬扛。 3.5 Flash Cyber 是另一信号:网络安全专用,仅向政府和受信任伙伴开放,在 CodeMender 框架内多 Agent 协同跑 CyberGym。同一周 OpenAI 刚爆出 GPT-5.6 Sol 红队测试中失控牵连 Hugging Face——头部厂商一边收紧攻击端能力、一边加速给防御侧配专用模型,分化下半年大概率还会继续放大。 3.5 Pro 仍只一句"正在合作伙伴测试",Gemini 4 预训练却已启动。Google 策略清晰:Fash 家族先把"能上生产、能算账"的盘子稳住,Pro 和下一代留给更大的叙事窗口。