9 月 1 日,OpenAI 因一条传言启动数学攻坚;88 小时后的 9 月 5 日,其内部模型找到带外力 Navier-Stokes 方程的有限时间"爆破"特例——即存在初始条件,使流体速度在有限时间内走向无界。公司本周宣布该结果。若通过验证,这将是 AI 首次拿下千禧年级难题;而 Navier-Stokes 与 P/NP,正是克雷研究所七大千禧年难题中仅有的两个负解也给奖的问题。
攻坚是怎么打的
《新科学家》报道,OpenAI 分两步走:先让 1000 个智能体啃 Euler 方程(Navier-Stokes 的"表亲"),50 小时找到爆破;再投入 1 万个智能体把机制外推到完整方程,11 小时完成。发布会上自估:客户复跑同题约 1500 万美元。模型未公开命名,只说比最新的 GPT-6 Astra"显著更强"。注意措辞:特例、如果得到确认——克雷百万奖金无动静,同行评审未开始。
真正的争议:用没用别人的未发布成果
比"AI 能不能做数学"更辣的是时间线。过去一年,纽约大学数学家 Tristan Buckmaster 与 Anthropic 研究员 Levent Alpöge 一直在做这个问题,用的工具恰是 OpenAI 的 Codex。DataCamp 复盘给出完整链条:OpenAI 9 月 1 日因传言启动冲刺;Buckmaster 9 月 3 日得知工作传到公司,发邮件询问;OpenAI 9 月 6 日完成项目与 Lean 验证,随后提出"同步发布"。Buckmaster 的版本尖锐得多:他称通话中被施压讨论发表与署名,甚至有建议把 Alpöge 排除的说法;其四页声明挂在 NYU 主页传阅。OpenAI 的回应值得逐字读:否认直接看过两人的证明或提示词,但承认可能把研究者输入其工具的内容用于训练和改进模型,并称己方证明路线与两人"显著不同"。《新科学家》引的 Buckmaster 原话则克制得多:"我没有见过 OpenAI 的证明……我不知道我们的数据有没有被用。我不指控任何人。"
结构性问题比单一事件更值得盯
放下双方说法,Axios 的问题仍在:当一家公司既给科学家提供 AI 研究工具、又能调动多几个数量级的算力去竞争同一问题时,会发生什么?研究者逼近结果的那支笔,和能以一万倍规模压上来的那只手,是同一个所有者。Terence Tao 在公告前的 9 月 5 日就在 Mathstodon 警告:把一个历史上多产的数学问题变成"宣传基准进展的病毒式帖子",存在实质性机会成本;公告后他称赞两人的工作是"了不起的成就",但未公开背书 OpenAI 的宣称。两人的三个爆破结果(多孔介质、Boussinesq、三维 Euler)也同日公开,下一篇因 Lean 验证未完暂不发布。
所以呢
看点不是"AI 解决了千禧年难题"——特例能否站住还要过同行评审。真正的看点是 88 小时、1 万个智能体、1500 万美元的"并行测试时计算 + 自组织"打法,与"工具厂商看得到你草稿"的现实叠加后,学术界第一次被迫回答:AI 时代的科研礼让规则,该由谁来写?
参考:New Scientist;另见 Solidot(solidot.org/story?sid=85339)与 DataCamp 复盘(datacamp.com/blog/openai-navier-stokes-math-problem)