METAL

OpenAI宣称攻克千禧难题,随即卷入优先权之争

OpenAI宣布用1万个智能体解决了纳维-斯托克斯问题。它与一天前发表同方向证明的数学家,在作者名单和数据访问问题上各执一词。

OpenAI宣称攻克千禧难题,随即卷入优先权之争

图片:METAL

摘要

  • OpenAI于9月8日宣布,由未公开的下一代模型率领的约1万个智能体证明了纳维-斯托克斯问题的陈述C和D。
  • 公司表示不会申领克雷研究所的奖金,并称是在听到Anthropic方面的传闻后于9月1日开始这项工作的。
  • Bubeck反驳称从未提出把Alpöge从作者名单中去掉,Tao则批评难题正被当作营销证据使用。

OpenAI于9月8日宣布拿出了纳维-斯托克斯千禧年问题的解答。据公司博客和官方X账号,这份证明由一支智能体群完成,率领它们的是一款远强于GPT-6 Astra、尚未公开的下一代模型;证明的内容是官方问题陈述中的C和D,即受到光滑外力作用的流体会在有限时间内产生奇点。不过OpenAI明确表示,不会申领克雷数学研究所的100万美元奖金。

说得直白些,千禧年问题是克雷数学研究所在2000年选出的七道难题,解开一道就给100万美元。纳维-斯托克斯问题问的是,描述水或空气流动的方程会在什么条件下飙向无穷大,还是始终保持光滑。

数字压倒一切。按OpenAI的说法,工作从9月1日开始,约1万个智能体同时投入,仅在这道题上就用掉了270万条消息和约1300亿个输出token。解析证明在开始88小时后的9月5日得出,GPT-6 Astra又花了17小时用形式化验证工具Lean加以核实。《财富》报道称,这里面投入的计算成本约为200万美元。

时间点是这次发布的另一半。OpenAI自己表示,当Anthropic方面即将拿出解答的传闻流传开来时,它于9月1日启动了这项工作。而就在一天前的9月7日,纽约大学数学家Tristan Buckmaster发表声明称,他与在Anthropic任职的Levent Alpöge一起,在Claude和Codex的帮助下证明了欧拉方程的有限时间爆破,并在声明中写下了与OpenAI通话的内容。

两种说法如今正面相撞。Buckmaster写道,在9月6日的通话中,OpenAI的Sébastien Bubeck提出把隶属Anthropic的Alpöge从作者名单中去掉,他拒绝后被问“为什么要毁掉自己的职业生涯”。Bubeck在9月8日发布于X的帖子中反驳称,他从未要求把Alpöge从作者中去掉,那次对话是他为了协调双方的发布时间而主动联系的。

Bubeck也否认了数据访问的疑点。Buckmaster提出OpenAI可能通过他的Codex账户或训练数据看到了他们的工作,Bubeck则表示从未把两人的提示词或证明输入模型,也没有把智能体引向那个方向。OpenAI的博客同样写道,在两人公开之前,它没有通过任何渠道看到那项工作,并表示在受迫欧拉问题上承认Alpöge和Buckmaster的优先权。

数学界的反应冷淡而沉重。菲尔兹奖得主陶哲轩指出,AI公司正在把古老的数学难题当作营销证据,并写道,如果只剩下答案而没有留下洞见,孕育下一代数学方法的生态可能会崩塌。《财富》用“作弊”和“威胁”两个词概括了这场争议,哪一方正确尚未得到证实。

因此,这次发布需要把已确认和未确认的部分分开来读。存在一份通过Lean验证的证明、OpenAI表示不申领奖金、双方都声称没有看过对方的结果,这些是目前已确认的事实。谁先谁后、通话里究竟说了什么,两人的记录相互矛盾,也没有第三方核实。

对韩国读者而言,这件事意味着数学研究的竞争方式变了。一道100多年来无人能解的题,被1万个智能体在四天内推平,而谁先发布结果成了公司的成绩单。不是研究室的规则、而是公司的发布日程决定数学的速度,这样的局面真的发生了。

归根结底,这件事的胜负不在证明,而在程序。方程由Lean验证了,但优先权、作者名单和数据访问还没有任何人验证过,克雷研究所进入审查的那一刻,这套程序才会第一次成为正式记录。

评论