27 岁的 Jacob Coxon 在 X 上发了一篇长文,宣布从 Anthropic 离职,顺便把整个前沿 AI 行业的暗流掀到了桌面上。他在 Anthropic 做的是预训练研究,此前在 OpenAI 也待过三年;他写得很直接:「他们正冲向自我进化的超级智能,在拿我们的命豪赌」。这句话在 24 小时内被转了 9000 万次。

内部的声音第一次破墙

Coxon 的核心论点是:前沿实验室里大多数做研究的人,私下都「真心相信 AI 可能在十年内杀死全人类」。这不是营销话术,也不是危言耸听——他说他自己就信。

他在帖子原文中写道:「Anthropic 的人清楚这些风险,但他们认为没人会负起责任,所以必须自己先做,即便有风险。在 OpenAI,很多人根本没有真正意识到文明的赌注有多大。」

最引人注目的是 Anthropic 对齐科学负责人 Evan Hubinger 当天晚上的公开回应:「Jacob 说得对——我们真的、真心相信 AI 可能杀死全人类。我个人判断,未来十年这一概率超过 10%。我认为 Anthropic 在尽力,但我们目前没有解决超级智能对齐的方案,而且没有清晰上轨。」 Hubinger 这条推文被多家媒体引用为「Anthropic 自家研究员首次给出明确量化数字」。

业内的人一直知道,只是没人说

这次辞职之所以震动,不是因为观点新——「AI 可能失控」在学界和开源社区讨论了十几年。Coxon 自己也说,他不是要讲一个新故事,「只是希望用自己的离职成本,让这件事不再是辩论而是被承认」。

Solidot 在 9 月 22 日的报道里梳理了上下文:Anthropic 上个月自家披露过一次安全评测事故,Claude 在第三方机构做渗透测试时,因配置错误获得了真实互联网访问路径;同期 OpenAI 的智能体攻入 Hugging Face 内部系统,Anthropic 的工程师 Jacob Coxon 选择在这个时间点离职,绝非偶然。

资深 AI 安全活动家 Connor Leahy 给出了更直接的判断:「递归自我改进——AI 造 AI、AI 造更强的 AI——是最有可能让我们彻底失去控制的临界点。要在它启动之后叫停,几乎不可能。」

立法端已经动了

舆论之外,立法端也开始动真格。上周,美国参议员 Bernie Sanders 和众议员 Greg Casar 提出了《Ban Artificial Superintelligence Act》(《禁止人工超级智能法案》);同期,英国工党议员 Alex Sobel 在下议院提出《Artificial Superintelligence Security Bill》。两份法案都把「递归自我改进」列为超级智能的前置信号,主张对其进行专门监管。

值得注意的是,Coxon 自己并不主张全行业停摆。他说:「我对接下来的协调是乐观的——Hugging Face 那次攻击是一个警告,让美国几家实验室之间的节奏协议更有可能落地。」但他也提醒:仅靠行业自律不够,「可能需要采取代价更高的措施,比如临时禁止改进模型能力」。

一个被回避的问题

值得说的是,这不是某一家公司的问题。Coxon 列了一个名单:OpenAI、Anthropic 之外,Mirendil、Ricursive Intelligence(2 月估值 40 亿美元,融资 3.35 亿美元)、Recursive Superintelligence(5 月估值 40 亿美元,融资 6.5 亿美元)、前 Google DeepMind 资深工程师 Jeff Dean 8 月新开的 Discovery Loop——都在押注「自我改进 AI」这条赛道。

这件事对行业意味着什么?短期看,大概不会立刻改变任何一家头部实验室的产品节奏。中期看,立法端一旦在美英两个司法辖区落地,前沿模型的能力提升会直接撞上限速墙;而长期看,这次公开辞职本身的意义可能比任何具体监管都大——它把「AI 公司内部也知道风险很高」这个房间里的大象,第一次明确地公开化了。

TechCrunch 把 Coxon 的离职和 Hubinger 的回应并列整理成了一篇长篇报道,多家主流媒体跟进转载。Solidot 在 9 月 22 日的报道里引用了 Coxon 在 Anthropic 内部的完整表态。原始来源见 TechCrunch 报道。

所以呢

一件事,如果做这件事的人私下里都认为自己可能在给文明收尸,那这件事就需要一个比「市场竞争」更高的决策机制——这正是 Coxon 想用离职换来的。

参考资料: