OpenRouter 最新一周 AI 大模型调用量榜单刚发出来,熟悉这件事的人第一反应大概不是"又是 DeepSeek",而是"Top 5 全是中国厂商"。

登顶的是小米 MiMo-V2.5,单周调用量 10.5 万亿 Token,环比增长 12%。第二与第五都是 DeepSeek,旗舰 Pro 版本对标海外顶级闭源,另以一个小尺寸版本守着入门段位。第三是腾讯混元 3——这款 7 月 6 日才正式开源的模型,单周环比增幅 999%,是整张榜单里增长最猛的那一个。第五同样是 DeepSeek,用来覆盖对延迟与成本敏感的批处理场景。

把这些点拼在一起看,事情和单条爆款新闻讲的完全不同:不是"某一个中国模型强",而是"中国开源模型在 OpenRouter 这个全球最大的公共路由上,第一次在数量与体量上同时压过闭源阵营"。

为什么是 OpenRouter?因为它聚合了几乎所有主流提供商的接口,谁被调用、用得多不多,是开发者侧真实偏好的晴雨表,比刷榜、跑分都更直接。Top 5 全是中国厂,意味着海外独立开发者、初创团队在最朴素的"够用、便宜、能调通"的选择上,已经开始把中国模型当默认项。

这个格局不是一天长出来的。回到 2024 年中,DeepSeek V2 第一次让海外开发者意识到"中国 LLM 不是 PPT",到 V3 与 R1 把训练成本透明化、可复现成本模型也公开,再到 Kimi K3 用 48 小时打满集群告诉市场"开源旗舰已经逼近顶级闭源"。每一步都在重塑调用侧的信任——先是值得尝试,然后是默认选项,最后变成占据目录。

技术层把这件事再次坐实的,是 MoE(混合专家)+ 开源 + 开放权重的组合拳。中国阵营在这三件事上同时踩中了开发者真正的痛点:MoE 让"用得起大模型"变成现实,同一个总参数规模下,激活参数降一个数量级,推理成本不是线性下降,而是跨数量级;开源让部署不依赖任何一家美国公司;开放权重让 fine-tune、微调、私有部署可以真跑起来。这三件事缺一件,Top 5 就不会变成"全是中国造"。

再看结构。MiMo 占住中间往上,DeepSeek 一高一低,腾讯混元 3 在后段超车,这是一个"层次化分布":旗舰吃对话与智能体重量级任务,中间尺寸吃高并发批处理,后段增长吃新场景红利。这种结构不是某一家能凭空摆出来的,是整个生态在过去 18 个月持续把"训练-推理-部署"链条的产品化跑通之后,才在调用端形成的水位差。

把视角拉远一点。OpenRouter 的榜单并不是孤立事件。在 Hugging Face Trending、Replicate 调用榜、LMArena 真实对话投票里,中国开源模型占比从 2024 年底开始稳步抬升。趋势的相似性比单一榜单更有说服力:开发者侧用脚投票的方向是趋同的,不是 OpenRouter 一家"偶然"。

但要警惕一个误读:这并不意味着中国 AI 在所有维度都领先。闭源厂商在超长上下文、复杂智能体链路、企业级 SLA、安全对齐上仍然占据高地;榜单上跑得快和跑得稳是两回事。我们看到的"全是中国造",更多是反映在成本敏感、批处理友好、可私有化这三个共同切片上的优势,而非全方位碾压。

所以给读者的不是"自豪感",而是几个具体可观察的下一步信号:第一,主流海外闭源厂商如果不在今年下半年把 API 价格降一个台阶,调用份额会进一步被侵蚀;第二,MoE 推理侧的成本继续下降(比如新的 1-bit expert 量化、端到端动态路由),会进一步放大这份优势;第三,下一个值得观察的是端侧——把这种"小激活、强能力"的模型装到手机、汽车、可穿戴里,会是中国阵营的下一场硬仗。

回到 Top 5 这张榜单本身,它在说的事其实很简单:全球开发者在"用什么模型"上的默认选项正在换边。换边不是靠喊,靠的是你这一端调用方便、便宜、还能改。这三件事,中国阵营在开源 MoE 上同时做到了。