9 月 16 日,Mistral 与 Mozilla 同时发文,宣布 Mistral 模型成为 Smart Window(Firefox 内置浏览 AI 助手)的可选引擎,法国本月的首个新闻点,北美与加拿大是下一个主要市场;Mistral 的两位创始人把这次合作包装成"开源技术 + 开源分发"的路线图。表面看像是又一笔浏览器内置 AI 合作,但仔细读两份通稿会发现一个微妙的落差:Mozilla 把 Mistral Small 4 描述成"新增的一个模型选项",Mistral 那边则用"已渲染好"的口径,通稿措辞差异背后是开放权重模型第一次坐进浏览器助手默认菜单这件事本身。
不是排行榜上的,是把模型送进浏览器分发
Firefox Smart Window 早在 8 月 18 日就上线了,这次合作的核心变化是 Smart Window 原本有三个预设选项——Fast 用的是 Google 的 Gemini Flash Lite,Flexible 用的是阿里 Qwen3-235B-A22B-Instruct-2507,Personal 用的是 OpenAI 的 gpt-oss-120b——Mistral Small 4 加入后成为第四个预设,但 Mozilla 在表意里特地保留了一句"多家 AI 模型"的措辞,意味着 Mistral 并没有把其它三家挤掉,只是新增了一个位。与此同时,Mistral 的表意用"is now powered by"("现由 Mistral 模型驱动"),明显比 Mozilla 通稿更具排他意味,但这份话术里没有点 Mistral Small 4 的名字,这是 Mistral 母版与 Mozilla 之间一次明显存在"翻译损耗"的握手。
Mistral 选在这时候落子也是深思熟虑。8 天前的 9 月 8 日,Mistral 完成了一轮 30 亿欧元的融资,投后估值约 210 亿欧元(约 240 亿美元),三星领投,EQT 与 PSG Equity 联合跟投。一年前 ASML 领投的 C 轮估值是 117 亿欧元,十二个月涨了约 79%。Mistral 之前的商业模式走的是企业与公共部门,从来没有面向消费者的分发通路,这次合作正好补上了 Mozilla 端着 5.31% 全球桌面份额这个数字(8 月 StatCounter),Chrome 的 73.28% 是它的 13.8 倍。所以 Mozilla 给 Mistral 一个入场位,Mistral 给 Mozilla 一个 Chrome 没法抄的故事,这是典型的双向背书而不是纯技术选型。
开放权重里最贵的预设:Mistral Small 4 不是"小"
Mistral Small 4 是这次合作的实际模型选型,3 月 16 日发布,Apache 2.0 协议,API 名是 mistral-small-2603。最容易让人误读的一点是它的"小"字——119B 总参数,但每个 token 只激活 6.5B,典型 MoE 设计:128 个专家,每次推理选 4 个走通。这种设计上的"宽解释"在 Mistral 的官方口径里被描述成"用大模型的能力付小模型的推理成本"。上下文窗口 262,144 tokens,支持文本 + 图像输入,Apache 2.0 协议意味着 Mozilla 可以照宣传话术那样称之为"开源合作"而不是"供应商集成"。
放在 Smart Window 的预设队列里看,Mistral Small 4 是单 token 激活参数二轻的,gpt-oss-120b 激活 5.1B / 总 116.8B,Mistral Small 4 激活 6.5B / 总 119B,Qwen3-235B-A22B 激活 22B / 总 235B,Google 没公布 Gemini Flash Lite 的参数量;但出 token 价格层面,Mistral Small 4 在四个里最贵,每百万出 token 的挂牌价 0.60 美元,gpt-oss-120b 0.17 美元,Qwen3-235B-A22B 0.35 美元,Gemini 2.5 Flash Lite 0.40 美元。Mozilla 自己掏钱为每一个 Smart Window 会话结算,这意味着尽管 Mistral 在名单里标着"开放权重",它放在 Mozilla 的成本表上反而是最贵的那个——选开放权重的开源标签不必然等于选便宜。
隐私口径的字面读法
两份通稿都把隐私放在最显眼的位置。Mistral 那边的原话是:"对话默认不保存在 Mozilla 的服务器上,Mistral 等合作伙伴承诺零数据留存。"这两句话的主语不一样——前者是 Mozilla 的基础设施,后者是 Mistral 的基础设施。Mozilla 那边的"默认"是一个配置项,配置可被改;Mistral 的"零数据留存"是 API 层的承诺,意味着不持久化 prompt 与 completion,不用于训练。两者结合,才是 Smart Window 在读你打开的标签页时真正能依赖的承诺。
但有一个问题被两份通稿都绕过去了:实际推理发生在哪个数据中心。Mistral 那边反复用"主权 AI"("sovereign AI")这种语汇词,适合代表欧洲场景下本地化部署的实际诉求,但 Mozilla 与 Mistral 都没在通稿里点出具体地域,如果有数据驻留义务的买家需要在 AI Controls 里自己核实。
四个预设的实质意义
打开 Smart Window 的 AI 模型选择器,目前是四件套加一个 Custom 位——四件套是 Fast(Gemini)、Flexible(Qwen)、Personal(gpt-oss-120b)和新加入的 Mistral Small 4,Custom 位允许指向自己的端点,Mozilla 在支持文档里专门提示本地模型在某些能力上不一定稳定。三件套是开放权重,只有 Gemini Flash Lite 是闭源;四件套全部以托管服务的形式存在,选 Apache 2.0 模型不等于在你的本地跑推理,只等于跑在别人机器上的权重是公开可审查的——这是两种不同的承诺,但不是同一种保障。
这件事放在 2026 年的浏览器助手版图里看,意义不止 Mozilla 多了一个模型选型。Vivaldi 已经公开承诺不集成助手,把"保持人类式浏览"作为它的入口形式;Mozilla 选了反例。SideCar 这边,Mistral 显然押的是另一条相反方向——当 Mozilla 是中立分发者,选 Mistral 时,模型能力被欧洲本地化拉通,把"主权 AI"和"开源权重"打通,以一种 Mozilla 标签里的"四件套"形式落到用户身上。Claude 的 Anthropic、OpenAI 的 GPT、Qwen 的模型都坐在同一架菜单里,这一件事本身就是对开放权重在消费级场景的最可能落点的一种标定。
那么对于作为每天使用开源模型的开发者来说,这件事说明 K 个层面:开放权重模型不再只是企业 API 里的备选项,它开始坐到消费级助手入口的菜单里;Apache 2.0 的权重与 0.60 美元的出 token 单价并存的现实意味着开源不等于便宜,选模型时仍然要看每 token 的实际账单;浏览器作为分发入口的话语权比模型本身的领先程度更值得关注——Mistral 模型比 Anthropic 落后多少还在可争议范围,但 Mozilla 5.31% 的桌面份额能直接把 Mistral 推到几亿台机器前,这件事已经是既成事实。