一夜之间,K3 的本事被打到了免费档
9 月 11 日,月之暗面把一款叫 K2.8 Preview 的新模型扔进了 Kimi Code 和 Kimi Work。最大变化不在模型能力,而在权限:所有会员档位——从 Adagio 免费到 Allegro ¥699/月——全部开放 1M token 上下文窗口,而 K3 的百万上下文至今仍锁定在 ¥199/月的 Allegretto 及以上。
官方没有单独公布 benchmark 数据,但明确说「综合性能接近 K3」,思考效率比 K2.7 Code 显著改善,编码与 Agent 能力全面提升。Model ID 不变,仍是 kimi-for-coding,客户端和第三方工具零改动直接升上去。思考档位直接对齐 K3 的 low/high/max 三档,默认 max。
这是一个「过日子」模型
K3 是旗舰:2.8 万亿参数、KDA 线性注意力、1679 Elo 在 Frontend Code Arena 把 Claude Fable 5(1631)和 GPT-5.6 Sol 挤下榜首,从前代 K2.6 的 #18 一口气冲上 #1。但 K3 也是真贵——每百万 token 输入 3 美元、输出 15 美元,是对手的三分之一,但跑起来仍然吃资源。月之暗面自己在 K3 技术博客里承认,K3 对历史 thinking 内容敏感,会话中途切模型或 thinking 记录缺失都会让生成质量明显不稳定,模糊任务上还会主动越界做用户没要的事。
K2.8 Preview 显然是冲着另一件事去的:把那些不需要 K3 旗舰能力的日常代码补全、常规开发任务,用一个更便宜的版本接住。月之暗面同时宣布,关闭 thinking 后,K3 系列和 K2.8 Preview 的请求都会被路由到 K2.8 Preview(无思考)——用户日常写代码时其实已经在用 K2.8 了,只是不知道。
ARR 从 1 亿冲到 10 亿用了五个月
K2.8 这步棋的商业背景同样关键。据彭博社 9 月 11 日报道,月之暗面的 ARR 从 3 月约 1 亿美元,到 4 月 2 亿美元、6 月超 3 亿美元,8 月已突破 10 亿美元。公司内部目标是年底冲到 20 亿美元。K3 系列目前每天生成约 3000 亿 token。
要让 ARR 再翻一倍,光靠一个高成本的旗舰模型撑不住。K3 适合长程编程、Kernel 优化、芯片设计这种「必须用最强的」场景;而普通的代码补全、文件改写、单步调试这些用户每天在做的高频任务,正是 K2.8 这类低单位成本主力模型的战场。月之暗面把 K3 的能力下放到全档位,配合 8 月底启动的 Pre-IPO 轮 500 亿美元投前估值,节奏很清楚:先把用户量堆起来,把单位调用成本压下去,把 ARR 数字推到 20 亿。
估值与收入的剪刀差
8 个月里月之暗面的估值从 43 亿美元涨到 500 亿美元,差不多 8 倍。但按 500 亿估值和彼时公开的 3 亿 ARR 算,市销率约 167 倍。作为对比,Anthropic 大约 20 倍、OpenAI 约 40 倍、智谱万亿市值时约 94 倍——即便估值最高的智谱,也只到月之暗面的一半出头。
本月初彭博社还披露,公司已向港交所保密提交 A1 上市申请文件,启动港股 IPO 流程。如果按当前 10 亿 ARR 算,市销率回落到 50 倍附近,仍显著高于 OpenAI,但比 167 倍要顺眼得多。
为什么这个时间点推 K2.8
四个时间点拼在一起看:
- 7 月 16 日 K3 正式发布,1679 Elo 一战成名
- 8 月底 Pre-IPO 轮 500 亿美元投前估值
- 9 月初向港交所保密递表
- 9 月 11 日 Bloomberg 曝出 ARR 翻倍故事,同日 K2.8 Preview 上线
上市前的最后一次能力下沉,把「K3 很贵」和「K2.8 也很能打」同时讲给一级市场、二级市场和开发者社区听。K2.8 没有单独发 benchmark 是一个聪明的处理:避免在 K3 还在跑榜的窗口期引出新模型抢风头,同时给未来商业化留出调价空间。
一个判断
我倾向于把 K2.8 Preview 看成「K3 商业化的回收站」:把 K3 在 LMArena 上拿到的影响力,兑换成 K2.8 在 Kimi Code 日常请求里覆盖的频次。再换一句话:月之暗面已经把能力上限证明完了,从现在到年底的关键指标不再是「最强的模型还能不能更强」,而是「便宜的模型有多少人在用、每天吃掉多少 token」。K2.8 Preview 是这场仗的第一发子弹。
一个开放问题留给评论区:K3 的 thinking 链不稳定、K2.8 又必须接管所有无思考请求——这套流量切换在长会话里会不会让老用户感到体验回退?