OpenAI 用约 1 万个 AI 智能体连续攻坚 88 小时、宣称于 9 月 5 日找到 Navier-Stokes 方程失效特例的消息过去一周持续发酵,这桩"AI 攻克千禧年难题"的悬案终于等来了奖金管理方的正式回应。克雷数学研究所就 Navier-Stokes 问题发表公开声明:将按照既有评奖流程确认这项成果——而不是按照发布会的时间表。
百万美元奖金,卡在评审流程上
根据克雷研究所的规则,任何千禧年问题的奖金认定都要走完一套硬性流程:结果必须先发表在同行评审的期刊上,发表后至少满两年,并且获得数学界的普遍认可。对照这套规则,OpenAI 至今没有给出 Navier-Stokes 问题的完整证明,也就是说,即使后续一切顺利,"已解决"的官方认定最早也要到 2029 年才可能落定。新闻稿可以当天发,数学的验收周期是按年计的。
为什么规则这么不近人情
这套流程并非专为 AI 设置。克雷研究所在 2000 年公布七大千禧年数学问题,每题悬赏 100 万美元,至今只有庞加莱猜想被确认解决——俄罗斯数学家佩雷尔曼完成了证明,却拒绝领奖。千禧年问题的价值不在"谁的引擎跑得快",而在结论能否经得起整个数学共同体数年的反复检验。这份声明背后,是研究所在提醒:AI 产出再快,也得排进同一条验证队列。
数学界的抵触情绪已经摆上台面
值得对照的是,包括陶哲轩、新晋得主邓煜在内的 25 名菲尔茨奖得主刚刚发表联名公开信《A Severe Misalignment of AI in Mathematics》,批评 AI 公司把解决重大数学问题当作基准测试竞赛,认为这同数学界追求概念理解的本质目标之间存在严重错位。另一边,围绕这项成果本身的争议也未平息:有报道称其研究过程被指利用了尚未发表的学术成果。在这样的氛围里,克雷研究所选择按流程办,几乎是最稳妥也最意味深长的表态。
所以呢
对做 AI 的人来说,这件事的信号很清晰:LLM 的数学能力正在逼近可验证的前沿,但"能力"与"被承认的知识"之间,始终隔着同行评审这道墙。与其争论模型是否已经封神,不如盯住两个更硬的指标——证明有没有正式发表,以及两年后数学界买不买账。
参考来源: