Hugging Face 8 月 14 日发的《State of Open Models: Summer 2026 Observations》报告,被各种 LLM 头条讨论最多的还是「Qwen 拿下 2.045B Hub 下载」「15.1 万衍生模型」「GGUF 仓库一年涨 464%」这些流量数字。但工程团队如果只盯着这三条,会错过报告里更扎心的一块切片——前沿开源权重正在被许可证悄悄收回。

Hugging Face 在《Licensing: Permissive Dominates — For Now》这一节给出的最后一行原话是「the very top of the frontier is beginning to shift — Kimi K3 and Qwen 3.8 Max have recently added non-commercial restrictions and revenue-share requirements」。TUN 当日的二次解读也复述了这个判断。请注意时态:已经引入。这个变化对所有正在把 2T+ 当基座做蒸馏或下游实验的团队是直接的规划风险。

把免费当免费的错觉

中尺寸段(即 20B–500B)并没有同步收紧。报告里同一段给出,2026 年中国实验室发布的 178 个 20B 以上参数模型中,59% 用 Apache 2.0、22% 用 MIT,「almost none carry non-commercial restrictions」。换句话说,如果你一直用 Qwen2.5、Qwen3 系列里 < 70B 的那一档做下游,许可证体感没变;Apache 2.0 的可商用、商用衍生、再分发条件还在。

问题出在顶端——也就是各家愿意把「最大」「旗舰」「SOTA」当作营销词的体量。中国两家最大体量的开源模型已经签字了:美国也差不多,但理由不同。

美国的开源前沿许可现在长什么样

报告给出的同一尺寸段美国数据更难看:

  • 30% 什么都不声明,法律上等于 pure proprietary residency(不写条款不代表默认可商用)
  • 41% 自定义条款,各家自定义口径,有的不写商用免责、有的不写 patent grant
  • 只有 29% 是标准 Apache/MIT

这意味着 2026 年下半年,如果你在美国前沿开源模型上做模型合并、RAG、蒸馏、再训练、商用 SaaS,请先看 LICENSE 文件再决定部署,而不是看 README。报告原话也补了一句很重的判断:

The weights are given away on the most permissive terms available. The return has to come from somewhere else: API and cloud business, hardware and platform positioning, or the ecosystem position itself.

翻译:权重的最宽松许可就是被免费送出去了;厂商回收价值只能从 API、算力、硬件/生态位里抠。这是开源在 2026 下半年的物理现实。

工程师层面的具体含义

从产品角度「被免费下载」和「被自由使用」已经不是同一回事。请把这三点写进 release checklist:

  • 下游商业化前查 LICENSE。开源 != 商用。Kimi K3 引入非商用条款与「收入分成」字眼,等同于把「我能拿这个权重做产品并向客户收费」这件事明确搬出默认许可。下游必须先确认是否落到 K3 还是 K3-NC 哪个 distribution。
  • 边端项目要重新选旗舰。Moonshot 把 Kimi K3 设计成 2.8T 的旗舰,Qwen3.8 给了 2.4T;这两个体量已经超出普通 2×4090 工作站能一手推理的区间,所以下游团队之前靠「我去钻略小一档」规避许可证压力。现在最小可商用档位从 70B 抬到了 200B+ 之间的合理替代区——Qwen3.8-27B / Muse Glimmer 30B / GLM-5.3 等中量段目前都仍是 Apache 类条款。
  • 不要把"开放权重"当作"免费可商用"的代名词。HF 自己在报告的同一节里把 frontier 的 liberation 和 derivative corpus 的市场化分开了。这是 2024 年、2025 年我们还不需要刻意做的区分。

所以呢

Hugging Face Summer 2026 的核心结论是「Qwen 已经把 Llama 拉下默认基座」这句话传播完了,背后那几行许可证数据被各种「下载 30 亿」的新闻消费掉了。但对真正要把模型跑进产品栈的团队,下面这一行才是行动的起点:

在 2.8T / 2.4T 的体量上,许可证已经分成两栏了——左栏是 K3 / Qwen3.8-Max 这类带非商用 + 收入分成的前沿,右栏是中量段仍 Apache 2.0 的工业可用基座。下游项目选哪一栏,是合同问题不是技术问题。

未来 12 个月「我用什么模型」这种选型话题,会被越来越多「我用什么许可证」这个问题反向牵动。这才是 2026 年下开源生态真正值得提前布局的方向。

(参考资料:Hugging Face 博客《State of Open Models: Summer 2026 Observations》,2026 年 8 月 14 日发布:https://huggingface.co/blog/state-of-open-models-summer-2026。二次解读:TUN / The University Network 当日文章:https://www.tun.com/home/hugging-faces-2026-open-model-report-qwen-leads-hype-vs-reality/)