OpenAI再次把模型能力展示带到数学前沿。公司称,一款尚未发布的内部模型已在第二道价值 100 万美元的“千禧年大奖难题”上取得进展,但没有公开具体题目,也没有给出外部独立验证结果。
88 小时调用约 1 万个 AI 代理
首轮相关消息出现在 9 月 8 日。OpenAI当时表示,该内部模型已经生成一份经 Lean 验证的证明。Lean 是一种逐步检查数学证明的软件。OpenAI称,这份证明显示,描述空气和水等流体运动的纳维—斯托克斯方程可能出现“爆破”,即速度发散到物理上不可接受的无穷大。
按照 OpenAI的说法,完成上述证明大约用了 88 小时,并协调了约 1 万个 AI 代理共同工作。公司把这类公开难题视为衡量模型进步的外部标尺,而不是为了争取奖金本身。
外界猜测指向霍奇猜想
不过,这次新进展仍停留在公司口径。OpenAI没有说明第二道题具体是什么,也未确认外界关于模型名称的猜测。围绕未发布模型是否与传闻中的 Aeon 版本有关,目前也没有公司正式表态。
由于 OpenAI没有披露题目,学界和技术圈已出现多种推测。其中一种较多被提及的方向是霍奇猜想。这是一道提出已有 76 年的数学难题,涉及复杂几何对象中“孔洞”结构的计数与分类。
先前成果已引发优先发表争议
OpenAI此前围绕纳维—斯托克斯问题的表述,已经在数学界引发争议。纽约大学数学家 Tristan Buckmaster 发布四页声明称,他与 Anthropic 研究员 Levent Alpöge 已就相关证明方向低调推进近一年,并在 8 月 22 日完成工作,时间早于 OpenAI研究员 Sébastien Bubeck 得知此事。
Buckmaster称,Bubeck随后希望 OpenAI尽快先行发表,并提出如果 Buckmaster 不接受,就由他个人单独撰写,不再与在竞争对手实验室任职的 Alpöge 联名。Buckmaster还披露,对方曾以职业发展为由施压。相关说法来自其个人声明,OpenAI在文中未作确认。
几乎在同一时间,Anthropic也表示,Claude 模型在 11 天内完成了对费马大定理一份已有 358 年历史证明的形式化整理。随着多家实验室把高难度数学题作为公开测试场,AI 在数学研究中的竞争正在明显升温。
补充信息:对 OpenAI而言,接下来更关键的不是宣布“取得进展”,而是能否获得公司外部数学家的独立确认。按照过往经验,千禧年大奖难题相关成果的核验往往需要数年,而不是数周。










