Artificial Analysis 给 Mistral Large 4 的智能指数打出 38 分,与 GPT-6 Luna(max)、DeepSeek V4.1 Flash(max)同档,法国再次坐到「美中之外最强模型」的位置。38 分把韩国、阿联酋系模型压在身后;Le Chonk 这只「胖猫」是 Mistral 用 3800 张 Grace Blackwell 在欧洲自建数据中心从零训出的。

智能指数 38 分代表什么

按 Artificial Analysis 口径,Intelligence Index 把 reasoning、agentic、coding、知识任务折算成单一可比分数。Le Chonk 的 38 落在开源权重模型最拥挤的区间:DeepSeek V4.1 Flash(max) 39、GLM-5.3-Flash 36 附近、Qwen3.8 Max 与 Kimi K3 在 35-37 之间。Mistral 把多模态输入门槛放宽到单请求 100 张图(老版 8 张)是这条曲线的关键抬升器:文档图表、卫星图、工程图纸这类「图多于文」的输入,Le Chonk 不再需要切片拼装。

智能指数之外,Artificial Analysis 网络防御指数(Cyber Index)给出 50,和 GLM-5.3-Flash 平手,排在 MiMo-V2.6-Pro(56)之后。子项 CyberGym-E2E-AA 上 Le Chonk 拿到 82%,比 MiMo-V2.6-Pro(79%)、GPT-6 Luna(max, 78%)都高——这是开源权重模型不再被「拒答」卡住的特殊战场。

成本曲线在「头两周半价」之外仍然硬

Mistral 把单任务成本摆到对比图横轴,标价 $1.13 / 任务,首两周半价期间降到 $0.56 / 任务。对比 GLM-5.3-Flash($0.25)、DeepSeek V4.1 Flash(max, $0.27)仍是 4 倍级别。Mistral 的解释是首两周折扣「让体验铺出去」,权重开放后自有部署成本回到硬件层而非 API 标价层。对欧洲客户来说这条数字才合规:跑在自己机房里,token 不出数据中心,账单按算力走。

标准价 $1.36 / $4.18 每百万 token($0.14 / 缓存输入),512k 上下文,文本与图像进、文本出。Mistral 在欧洲运营独立,符合「主权 AI」叙事,但代价是同样智能指数下,token 单价比中国开源权重模型贵一截。

「不是中国也不是美国」本身就是一道保险

Le Chonk 不是技术突破——38 分在 2026 年 10 月不稀奇——它真正的新闻点在于供应源分散。法国 + 欧洲自建数据中心 + 完整权重月底落地 + 主权叙事,是一组绑定方案,直接回应企业「不敢用中国模型、也不敢只用美国模型」的两难。Microsoft-Mistral 几周前签下的 Vera Rubin GPU 主权云协议是同条曲线的另一端,Artificial Analysis 这条报道是在给这条曲线贴价格标签。

月底开源后,如果社区在 Mistral 训练配方上跑出微调,把 38 分推到 40-42 区间,Le Chonk 就会成为欧洲开源权重模型的新默认基线。在那之前,38 分这件事本身,和韩国 Solar Mini 4(24 分)、阿联酋系模型同档并列,已经够让「法国的 LLM 又回来了」成为今年的副标题之一。