数学史上的一件大事,如今被OpenAI演绎成了一部跌宕起伏的连续剧。就在数学家们指控其涉嫌抢功之际,OpenAI紧急官宣:他们已利用内部尚未发布、能力远超GPT-6 Astra的模型,攻克了纳维-斯托克斯存在性与光滑性问题。这是克雷数学研究所悬赏一百万美元的七大千禧年难题之一,此前仅庞加莱猜想被攻克。陈立杰透露,他年初加入时预测2028年解决,没想到进度条被AI狂拽,5月破一题,9月连破两题。OpenAI还暗示,解决这道题的并非GPT-6,而是训练中的更强内部模型,Astra只是负责“检查作业”。
为了攻克这道题,OpenAI动用了约一万名智能体并行工作88小时,发送了270万条消息,消耗了约1300亿输出Token。Agent完成后,GPT-6 Astra又花费17小时,将证明形式化并逐步检查漏洞。《科学美国人》评价这是数学界至少20年来最重要的一天。然而,就在数学界准备鼓掌时,事情变得微妙起来。
传闻OpenAI之所以突然出手,是因为风声走漏,得知有人即将解开这道题。被抢先的团队是纽约大学数学家Tristan Buckmaster和Anthropic研究员Levent Alpöge。两人一直在研究流体方程爆破,且使用了OpenAI的Codex工具。OpenAI被指控试图将Alpöge从作者名单中剔除,理由是他来自竞争对手Anthropic。
纳维-斯托克斯方程描述流体运动,从浴缸排水到天气系统都涉及。数学家百年来无法证明三维流体在初始平滑且无外力情况下,能否永远保持平滑,还是会在有限时间内出现奇点(爆破)。OpenAI证明的是在施加平滑外力的情况下,流体会在有限时间内冲向无穷大,且总能量有限。这完成了克雷研究所题目中的C和D两种情况。OpenAI称不打算领取奖金。
9月1日,OpenAI听到传闻,启动内部模型测试。约1万个Agent并行工作,总计消耗约3000亿输出Token,仅纳维-斯托克斯一题就吃掉1300亿。这相当于用数百万美元算力解了一道百万美元的题。Buckmaster和Alpöge原本计划整理AI生成的“AI垃圾”后发表,结果被OpenAI抢先。他们使用的Codex会话数据可能被模型利用。
Buckmaster质问OpenAI是否访问了他们的Codex会话。OpenAI否认查看,但称无法排除通过去标识化数据改进模型的可能性。随后冲突升级。Buckmaster称OpenAI提出两套方案:一是他们先发欧拉方程,二是他署名OpenAI的纳维-斯托克斯证明。Buckmaster拒绝,并称OpenAI研究员Sebastien Bubeck两次提出将Alpöge从作者名单中除名,理由是他是Anthropic员工。Buckmaster威胁公开全过程,对方反问:“你为什么要毁掉自己的职业生涯?”
OpenAI的Bubeck回应称,他从未要求将Alpöge从两人的欧拉方程论文中除名。当时讨论的是Alpöge作为Anthropic员工,是否适合署名OpenAI内部模型的研究成果(特别是两人欧拉方程证明也用了Anthropic模型)。Bubeck表示“如果Levent不是Anthropic员工,事情会简单得多”。
OpenAI解决的并非大家通常认为的“无外力”核心问题,而是“存在平滑外力”的情况。这完成了克雷研究所题目中的C和D部分,但核心的无外力版本仍未解决。OpenAI完成了官方题目,但未满足数学界默认的“无外力”标准。
