7月27日,OpenRouter最新数据显示,小米MiMo-V2.5同时拿下全球大模型调用量周榜与月榜双第一,是当周唯一突破10T tokens的模型。从5月至今,其单周token量从1.46T攀升至10.46T,两个月增幅约616%。 这一成绩之所以值得认真看,是因为OpenRouter是全球最大的LLM API聚合平台,榜单按真实调用量排序,不是benchmark刷分,意味着全球开发者用脚投票选出了它。MiMo-V2.5背后是MoE架构(总参过万亿、激活42B),混合注意力比7:1,1M上下文,定价仅Claude Opus 4.6的不到1/3——性价比路线把开发者从闭源高价模型里抢了回来。 放到更宽的坐标系看:2026上半年中国大模型已经不止在榜单上刷分,而是开始拿走真实流量。Hy3、Kimi K3、Qwen、MiMo轮番登顶OpenRouter。闭源前排模型在Coding Agent、Tool Use这些核心场景里依然领先(MiMo-V2-Pro的ClawEval 61.5 vs Opus 4.6的66.3),但调用量曲线已经反向。 这不是国产替代的鸡汤故事。MiMo-V2.5跑赢的不是技术上限,而是技术性价比——用1/8的推理成本做八成的能力。这条路如果被DeepSeek、Qwen复刻并扩张,闭源模型靠能力溢价撑高价的窗口,会比所有人预想的更早关闭。