三周迭代:Google 把 Flash 的发布节奏卷到了新量级
2026 年 8 月 13 日,Google AI Blog 发布 Gemini 3.7 Flash,这是 Gemini 3.6 Flash(2026 年 7 月 21 日发布)之后仅 3 周就推出的新版本。Google 高级产品总监 Tulsee Doshi 在官方博文中称 3.7 Flash 是「我们迄今为止最智能的工作马模型」,专为编码和 Agent 工作流设计。
把发布节奏压到 3 周,在 Flash 系列里是第一次。3.6 Flash、3.5 Flash Lite、3.5 Flash Cyber 三个模型 7 月 21 日同期上线,3.7 Flash 立刻跟上。Google 给出的解释是「开发者反馈 + 算法创新」,但这种节奏本身就是一个工程信号:前线的反馈循环已经被 AI 改写到以周为单位。
代码能力的关键 benchmark 跳变
3.7 Flash 的核心提升集中在代码和长上下文知识任务,以下数据来自 Google 官方博客:Introducing Gemini 3.7 Flash。
- FrontierCode 1.1 Main:43.6%(3.7)对比 34.4%(3.6),9.2 个百分点的提升
- DeepSWE v1.1:65.3% 对比 49.0%,提升 16.3 个百分点
- WebDev Arena Elo:1588 对比 1538
- GDP.pdf 复杂文档理解:34.0% 对比 22.0%,提升 12 个百分点
- AutomationBench(Zapier 真实工作流):30.4% 对比 17.0%,提升 13.4 个百分点
特别值得注意的是 DeepSWE v1.1 和 AutomationBench——前者是 Cognition 推出的软件工程基准,后者是 Zapier 用来衡量「模型能不能在真实业务工作流里代替人」的评估。3.7 Flash 在这两个基准上的跃迁幅度都超过 13 个百分点,说明 Google 不只是把 Flash 的代码能力做「更稳」,而是直接往「能干更复杂的工程」上推。
半价促销:把价格再次腰斩
3.7 Flash 的定价策略同样激进。Google 给出「introductory price」——每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,有效期到 2026 年 12 月 31 日。这是 3.6 Flash 的一半价格。2027 年 1 月 1 日之后,价格回到 1.50 美元 / 7.50 美元每百万 token。
这把「价格减半 + 能力提升」同时打包,实质是 Google 在用价格换 Agent 时代的开发者份额。Box、Browser Use、Cartwheel、Harvey、Hebbia、LangChain、Nunu.ai、Open Code、Pydantic、Stanford 生物学系等一批企业客户和 Agent 框架被官方作为早期客户列出。Stanford 生物系的引用尤其值得关注——它意味着 3.7 Flash 在「知识密集型学科」的可信度被一线研究机构背书。
可配置的思考强度
3.7 Flash 的 Model Card 里明确写了一句:支持可自定义的思考配置,以控制质量、成本和延迟之间的权衡。
这跟 Gemini 3.5 Pro 那种「全自动 thinking」路线不同——3.7 Flash 把思考强度暴露给开发者,让企业可以根据任务复杂度调节,而不是按 token 计费统一拉到顶配。对于真实生产部署,这意味着低延迟场景(自动补全、UI 渲染)可以关掉深度推理,复杂任务(代码重构、合同审查)再开满,边际成本结构更可预测。
160 个国家的 Gemini Spark 即日切换
3.7 Flash 即日起成为 Gemini Spark 的底层模型。Spark 是 Google 在 I/O 2026 上推出的「7×24 个人 AI Agent」,面向 Google AI Pro 和 Ultra 订阅用户,在 160 个国家上线。Spark 这次切到 3.7 Flash,意味着所有 Spark 用户都会「不知不觉」地用上更强的工具调用和工作流编排能力——这是 Google 把模型升级与产品升级同步推进的一次操作。
安全侧:CBRN + 网络攻击双加固
3.7 Flash 同步更新了 Frontier Safety 的安全边界,对化学、生物、放射、核(CBRN)和网络攻击滥用场景做了新的针对性防护。Google 同时强调这一加固是「在阻止滥用的同时保留有益用途」,并提供了生物安全和网络项目的公开文档链接。安全框架跟产品同步迭代是过去 18 个月里前沿模型的标准做法,但 3.7 Flash 把这一步骤写在博客头条,说明 Google 是在回应监管和投资人最近对模型滥用的持续关注。
接入入口
开发者可通过 Google AI Studio 的 Gemini API、Android Studio、Antigravity 平台调用 3.7 Flash;企业可通过 Gemini Enterprise Agent Platform 和 Gemini Enterprise app 接入;个人用户可通过 Gemini app 的 Spark 体验。
我的看法
Google 把 Flash 系列的发布节奏卷到 3 周一次,本质是在用「工作马模型高频小步快跑」反制 Anthropic Claude Opus 5、OpenAI GPT-5.6 Sol 这种「季度性大版本」路线。3.7 Flash 在真实软件工程基准上 16 个百分点的跃迁,加上价格腰斩,这两件事叠加意味着:Agent 时代的开发者心智正在从「哪个模型最强」切换到「哪个模型性价比最好、能撑得住生产部署」。Google 选择把筹码压在 Flash 而非等待 Gemini 3.5 Pro——这个选择本身,就是 Google 对模型发布策略的一次重新校准。