8 月 20 日,OpenRouter 与 OpenCode 同时上线一个代号 Ox Alpha 的匿名大模型预览。它以 1,048,576 token 的上下文窗口、文本/图像/视频输入、最大 131,072 token 输出,把"推理模型"和"长程 Agent 工作流"的接口规格直接拉到了当前第一梯队的位置。OpenCode 同期声明该路线对全部用户免费一周、并把每日算力容量定为 100 万亿 token;OpenRouter 上的 prompt 与 completion 价格同样标为零。问题在于:没人署名。OpenRouter 把它挂在通用名 "Stealth" 提供商之下,OpenCode 直接称之为"the stealth model",Zhipu AI、OpenRouter、OpenCode 三方至今没有给出任何一方的公开确认。
独立指纹给出了一个指向 Zhipu 的答案
真正让这件事进入技术圈视野的,是 OpenRouter 用户社区在 36 小时内完成的两轮指纹测试。第一轮由 @aitrackerbot 主导,在 25 条多样化提示词上对比候选模型的原生 token 数。结论是:Ox Alpha 的 token 数与 GLM-5.3 完全一致,仅存在一个恒定的 +75 token 偏移——后者被研究者归因于 OpenRouter 或上游包装层加入的系统提示,与底座身份无关。第二轮把维度升到视频编码器。Ox Alpha 在 4 段受控视频上对帧采样、~147 token/秒 的时长缩放、按帧分辨率的扩展三项独立设计选择,与 Zhipu 自家 GLM-5V-Turbo 的实现逐 token 重合。三个独立设计同时撞车的概率,远低于单个 token 数对得上。同源社区 huggingnews 也在同一时间独立得出"指纹指向 GLM 5.3 视觉变体"的判断。
研究者把置信度设在 ~90%,措辞为"强烈指向但官方未确认"。Zhipu 至今保持沉默,既没有承认也没有否认;OpenRouter 与 OpenCode 同样拒绝在记录中点名任何实验室。
排除项与"为什么是隐身"的逻辑
同一轮测试也排除了两个流传最广的替代猜测。小米 MiMo v2.5 的音频端点行为与 Ox Alpha 不同——后者在所有路由上都拒绝音频输入,行为与 GLM-5V 系列对齐,而 MiMo v2.5 原生支持音频。Qwen 3.8 Max 与 GLM-4.6V 也跑过同一套指纹,tokenizer 与视频编码器签名都与 Ox Alpha 不匹配。aiwiki 的复核则把另一组关键事实钉死:OpenRouter 模型 API 把 Ox Alpha 的 tokenizer 标为 "Other"、知识截止留空、量化方式 unknown、Hugging Face 仓库 ID 缺失;任何一项单独看都不能证明身份,但合在一起说明这不是一次普通的命名疏忽,而是一次刻意的隐身。
这恰好契合今年早些时候 Hunter Alpha、Healer Alpha 两次小米 MiMo 隐身预览的剧本:在 OpenRouter 这种中立平台上以匿名形式放出、收集生产级流量与失败案例,然后在窗口期结束后再以官方身份正式登场。区别是这一次的指纹指向的不是 MiMo,而是 GLM。
不该被忽略的几条边界
值得注意的是,这条"Ox Alpha = GLM-5.3"的结论有几个公开的边界。第一,DeepSWE 上有用户用 10 道题做过非受控跑分,宣传位次"领先 Fable 与 GPT-5.6 Sol"——但 aiwiki 已指出样本量太小、缺任务 ID 与种子、缺完整轨迹,不能视作官方榜单成绩。第二,OpenRouter 与 OpenCode 各自的隐私条款不一致:OpenRouter 路径下 EULA 授权数据用于训练与改进,OpenCode Zen 才是真正的"零保留"——这意味着开发者用 Ox Alpha 跑真实业务时不能把"两条路径都匿名"当作统一承诺。第三,1M token 是容量而非有效推理深度:"Lost in the Middle" 与 RULER 都未对 Ox Alpha 做受控长上下文测试,长文档中段的检索与多跳推理能力仍是黑盒。
所以呢
如果最终公开身份确认是 Zhipu,这意味着头部中国实验室愿意用"先在海外中立平台裸奔一周、收集真实流量、再以官方身份复活"的方式做压力测试,与一年前 DeepSeek V3 走过的路径有显著不同——后者更倾向于发论文,而前者直接用生产请求做"无标签基准"。无论指纹结果如何,这件事本身的"隐身→证据链→等待官方确认"三段式流程,本身就是 2026 年开源大模型生态的一堂新公开课:模型署名不再是发布的前提,但署名迟早必须到来。