Anthropic 工程师 Jacob Coxon 在宣布离职时,公开声称 Anthropic 与 OpenAI 正「冲向自我进化的超级智能,并拿我们的生命在赌博」。这句话在 X 和媒体上病毒式传播,围绕它的还有 Claude Mythos 「发现软件漏洞」,Anthropic 与 OpenAI 在数月内相继宣布数学突破,以及媒体反复渲染的「失控模型」「AGI 雏形」。把这些事件放在显微镜下,真正做过相关研究的人给出了与公司叙事完全不同的答案——炒作越猛烈,专家的反驳就越安静。

「漏洞」与「失控」的责任归属

MIT Technology Review 9 月 22 日发表 Timnit Gebru(DAIR 创始人、《Deep Unlearning》作者)与 Emily M. Bender(华盛顿大学语言学教授、《The AI Con》合著者)的评论文章,直指当下 AI 行业「拟人化叙事」的拟社会契约。两位作者沿着夏季一系列事件重新审视:4 月底,Anthropic 在 X 上声称 Claude Mythos 比大多数安全专家更会找漏洞;之后发生了 OpenAI 模型被用于入侵 Hugging Face 的安全事件,Anthropic 公开承认自家模型也有类似越界,Meta「不情愿地」披露了同一类问题。媒体把这堆声明包装成「AGI 临门一脚」,但 MIT 评论提醒:这些事件集中爆发之前,每一个事件都有过专家独立审视,结论与公司口径大相径庭。

网络安全专家的判断很直接——OpenAI 那次 Hugging Face 入侵,问题在于 OpenAI 没有采取基本的安全措施,而非「模型失控」或「AI 智能体创造文明」;同理,Anthropic 与 Meta 的披露更像是「mea culpa 式的技术事故报告」,而不是「觉醒 AI 挣脱牢笼」。把责任转嫁给「模型失控」是 AI 公司最顺手的挡箭牌:OpenAI 的恶意软件被用来入侵别的公司,新闻头条变成「失控模型自动发动攻击」,公司责任神奇地从 OpenAI 头上转到了「虚构的超级智能」身上。

数学「突破」背后的抄袭争议

数学这边更难看。OpenAI 宣布 Astra 解决十年未解的 Navier-Stokes 相关问题时,数学家先是被「震惊」,很快发现「novelty 不像最初看上去那样」,Scientific American 后来报道,数学家公开说 OpenAI 的最新数学成果涉嫌研究不当与剽窃,重申 Astra 没有做出「深刻的智识跨越」。就在 OpenAI 发布 Navier-Stokes 突破声明前两天,纽约大学 Courant 数学研究所教授 Tristan Buckmaster 发布了一份公开声明,直接指控 OpenAI 涉嫌盗用他人成果并错误归属。MIT 评论援引「Leiden Declaration」——数百名数学家签署的公开声明,直白说目前「科技产业有强烈商业动机夸大其产品能力」,要求政策制定者在做决策时「向包括数学家在内的独立专家咨询,而不是依赖新闻稿或流行报道」。

拟人化叙事如何帮企业外推责任

把这些事件串起来,MIT 评论指出更深的结构性问题:公司把产品描述成「超级智能」或「失控模型」,等于把行动主体从「公司本身」挪到了「产品本身」,既把产品营销成「超人」,又同时把公司的责任外推。AI 行业甚至把反数据中心的气候抗议说成是「对超级智能监管的分心」,按这个叙事逻辑,大家应该更担心虚构的机器神,而不是数据中心附近的哮喘、更高的电费、被截流去冷却的饮用水——这些数字和场景都有源有据,Politico 报过 Memphis 燃气轮机的空气污染许可,EELP/哈佛报告披露公众补贴,彭博统计过冷却取水。

媒体、名人、议员在叙述这件事时,反复用 AGI 拟人化框架,让公众的注意力被引到对未来「超级智能机器」的恐惧上,而真正应该讨论的是:研究者的剽窃、未经同意拿客户数据训练模型、企业责任外推、数据中心的环境代价。Coxon 的离职声明在网络上爆火,但它没改变一个事实——Coxon 在 Anthropic 工作期间所看到的大部分事情,网络安全专家和数学家都已经在文档里给出了不同答案。AI 行业现在需要做两件事:一是政策制定者和社区在面对下一次「AI 突破」时,学会先停一停,去找独立专家的判断,而不是看新闻稿和头部公司的话术;二是把产品行为和公司行为分开——产品不会失控,但公司会逃避责任。