导语:OpenAI向《纽约时报》表示,已在另一个千禧年大奖难题上取得“实质性进展”,但未披露具体是七个难题中的哪一个,并强调不寻求100万美元奖金。数天前,该公司刚宣称在纳维-斯托克斯方程上取得突破。
社交媒体猜测集中在霍奇猜想。该问题提出于1950年,关注如何用代数方法计算复几何形状中的“洞”。数学家长期寻找代数捷径,但尚未证明其始终有效。OpenAI未确认这一猜测,也未证实其工作使用了未发布模型“Aeon”的传闻。该模型被描述为面向长周期任务和代理式工作流。
9月8日,OpenAI称,一个未发布的内部模型生成了经Lean验证的证明,显示纳维-斯托克斯方程可能爆炸为物理上不可能的无限速度。据报道,该工作动用了约10,000个协调AI代理,运行约88小时。纳维-斯托克斯方程支撑飞机设计、天气预报和血流建模,近90年来一直缺乏完整数学解释。
但纳维-斯托克斯的宣布引发争议。纽约大学数学家Tristan Buckmaster表示,他与Anthropic研究员Levent Alpöge已追踪相关证明近一年,并于8月22日完成。OpenAI的Sébastien Bubeck得知后试图抢先发布。Buckmaster称,Bubeck要求他要么让OpenAI在其团队完成次日发布,要么在没有Alpöge的情况下单独成文,因为Alpöge就职于竞争对手实验室。据称,当Buckmaster拒绝时,Bubeck问:“你为什么要毁掉自己的职业生涯?”
同一周,Anthropic表示,其Claude模型在11天内形式化了费马大定理的358年历史证明。数学家陶哲轩警告,AI实验室之间的竞赛正在消耗数学中困难而有用的难题供应,新问题的发现速度跟不上。
OpenAI表示,它把千禧年大奖难题用作衡量模型进步的公共标尺,并非追逐100万美元奖金。下一步考验在于,克莱数学研究所或外部数学家能否独立确认其中任何一项声明。过往提交的确认过程往往耗时数年,而非数周。
