OpenAI周二宣布已解决数学界传奇的千年大奖难题之一,这本该是值得庆祝的时刻。这一成果无疑是一项成就,也生动展示了AI正在多么迅速地改变数学领域。但在正式公布之前,这一突破就因促使OpenAI着手解决该问题的异常情况而变得复杂:在听说其他研究者正在取得进展后,该公司似乎调动了大量资源,在最后关头抢先完成了这项工作。随之而来的争议已浮出水面,涉及抢发成果、监视行为以及公然违反长期学术规范的指控,研究者担心这可能对整个领域产生寒蝉效应。

伦敦玛丽女王大学数学教授阿比舍克·萨哈解释说,OpenAI所做的正是"数学家们通常不会做的事情"。

在周二发布的一篇博客文章中,OpenAI表示其一个未发布的模型仅用88小时就找到了纳维-斯托克斯问题的解决方案,这是一个关于流体运动的棘手难题。由于解决该问题可获得100万美元的奖金,它是数学界研究最深入的问题之一,但近90年来一直难住了人类研究者。OpenAI表示,其模型通过让约1万个由内部模型驱动的AI智能体集中攻克这一任务而得出解决方案,并将这一成就誉为一个"里程碑"。

"如果你不想让我表现友好,那我也不必友好。"

但这一公布的时间点引发了质疑。就在前一天,纽约大学数学教授特里斯坦·巴克曼与OpenAI的主要竞争对手Anthropic的研究员莱文特·阿尔波格(此处阿尔波格并非代表其雇主工作)共同发布了一个相关问题的研究成果。巴克曼表示,在得知OpenAI已经知晓他们的研究进展后,他联系了OpenAI,询问该公司何时开始研究这个问题,以及其模型的训练数据来自哪里。他说,谈话很快变得不愉快,一位OpenAI研究员在他表示会公开此事时问道:"你为什么要毁掉自己的职业生涯?"当他反问为什么公开此事会毁掉他的职业生涯时,巴克曼说他得到的回复是:"如果你不想让我表现友好,那我也不必友好。"OpenAI转而敦促巴克曼发表这项研究成果,并将OpenAI的内部模型列为共同作者,同时把阿尔波格从共同作者名单中去除。

巴克曼表示,他曾问OpenAI是否曾访问过他在Codex上处理该问题时的会话记录,但OpenAI的回应变得越来越含糊其辞,甚至带有敌意。此后,包括在宣布这一成果的博客文章中,OpenAI明确否认使用了任何特定用户数据。该公司表示:"我们(研究人员和智能体)在他们公开发布之前,没有通过任何方式看到过他们的工作——特别是,没有为解决这个问题而访问任何特定用户数据。"

但OpenAI无法完全排除间接影响的可能性。该公司表示:"尽管可能性不大,但我们不能排除从他们使用我们产品中衍生出的去标识化数据有助于改进我们模型的可能性",同时强调两份证明存在显著差异。OpenAI研究人员在X平台上的评论也呼应了这些否认。

要准确说清究竟发生了什么并不容易。时间线错综复杂,研究内容存在重叠,而AI生成工作的来源在最理想的情况下也很难甚至不可能确定。而且,不同的参与者竞相解决世界上最著名的数学问题之一——尤其是这个问题还附带着一笔可观的奖金——这本身也并不令人意外。

但OpenAI说法中的一些细节难以解释。据该公司自己的说法,这项工作是仓促且极其昂贵的,耗费了数百万美元。然而该公司表示无意申领这笔奖金,况且,负责管理该奖金的克莱数学研究所至今尚未颁发这笔奖金。该公司表示,其唯一目标"是报告我们AI模型的重大进展"。该公司似乎在9月之前并未在纳维-斯托克斯问题上投入太多精力,或者即便投入了,也未曾公开谈及此事。

那么为何如此仓促?

OpenAI的解释实质上等同于一句响亮的"为什么不呢?"该公司表示,在听到其他研究者正在千年大奖难题上取得进展的传闻后,开始着手研究这个问题。OpenAI研究员塞巴斯蒂安·布贝克在一次媒体简报会上表示(据《科学》杂志报道),他们是"在推特上"听到这些传闻的。布贝克说:"于是我们心想:'我们的模型如此强大,为什么不也试着解决一个千年大奖难题呢?'"

OpenAI表示,他们后来才意识到这些传闻涉及的正是阿尔波格和巴克曼。除了回应巴克曼关于使用其数据的指控外,OpenAI没有公开回应他的其他说法,并在被要求置评时将《The Verge》引向了其博客文章。被巴克曼在其陈述中提及的布贝克,对部分内容提出异议,否认自己曾要求巴克曼将阿尔波格从共同作者名单中移除。

即便抛开最具爆炸性的指控,OpenAI公开承认的一些行为方式也已让数学家们感到震惊。抢在其他研究者之前得出结果的这种仓促做法,在大多数情况下根本不是数学研究应有的方式。萨哈表示,抢发成果确实会发生,但并不容易。

他解释说,这部分是因为前沿研究往往需要极其深厚且专业的专业知识,即便有人想要抢先介入,也很少有人具备这样的能力。

开放性是这一学科中根深蒂固的美德。南卡罗来纳大学数学教授、计算机辅助数学推理研究所(ICARM)科学活动副主任马修·巴拉德表示:"数学在很大程度上依赖于一种非正式的信任规范。研究者们习惯于与同行分享不完整的想法和正在进行的工作,以此打磨自己的思路。这样做的前提是,这种分享不会演变成一场竞争。"

卡内基梅隆大学教授、同时也是ICARM主任的杰里米·阿维加德表示,尽管他无法评论对话记录是否曾被访问,但"一想到AI系统可能从我们的查询中窃取想法,就让人感到不寒而栗"。数学家们习惯于谈论自己的研究工作,而不必担心被人抢发成果。"现在,哪怕是最细微的线索,也可能足以让拥有足够计算资源的人调动一大批智能体去解决这个问题,人们很可能会变得更加谨慎。想到这可能如何改变研究环境,真是令人难过。"

"数学在很大程度上依赖于一种非正式的信任规范。"

OpenAI不愿意或无法说明其模型是否受到了其他数学家研究工作的影响,这加剧了该领域的不安情绪。布朗大学教授布伦丹·哈塞特对《The Verge》表示:"这是个问题",并补充说,"鉴于AI公司过去曾未经许可或付费就挪用受版权保护作品的历史,人们自然会提出这些问题。"他表示,各公司"应当被要求兑现承诺",证明聊天记录不会被用于改进其模型,这包括能够拿出证据证明这一点。

目前尚不清楚事情接下来会如何发展。伦敦数学科学研究所研究员杨-辉·何在北京参加一场会议期间撰文表示,他担心"大公司主导下的数学研究变得过于保密"。作为一个自称"始终对AI持乐观态度"的人,他承认自己担心数学研究可能会退回到过去那种更加保密的状态,就像历史上曾由美第奇家族等富豪家族出资赞助的时期一样。

对大多数研究者来说,情况可能不会有太大改变。萨哈推测,像OpenAI及其竞争对手这样的公司,愿意投入如此巨额资金去解决的高难度问题数量毕竟有限。"你不能指望AI实验室对大多数人们正在研究的问题倾尽全力,因为这些问题根本得不到足够的关注度。"

获得关注度或许正是问题的一部分所在,这也有助于解释为什么OpenAI决定抢在一个已知与Anthropic某研究员有关联的问题上展开竞争,即便该研究员是独立行动的。牛津大学教授安德拉斯·尤哈斯表示:"这显然是OpenAI的一次公关胜利。"

但尤哈斯质疑这种做法能否持续下去,他想知道,既然模型已经能够攻克一些最大的数学难题,这是否意味着AI公司参与数学研究即将走向终结的开始。他表示,人类数学家之间也会互相抢发成果,不过OpenAI的所作所为表明,这种情况可能会以更大规模发生。他说:"突然间,1万名'数学家'同时扑向你的问题。"

所有这些都可能让OpenAI的公关胜利变成一场得不偿失的胜利。该公司再次证明了其模型能够在数学最前沿展开竞争。但在这个过程中,该公司似乎疏远了它一直努力想要打动的这个学术社区本身。

Q&A

Q1:OpenAI解决了什么数学难题?

A:OpenAI宣布解决了纳维-斯托克斯问题,这是一个关于流体运动的千年大奖难题,附带100万美元奖金,近90年来一直未被人类研究者攻克。

Q2:OpenAI是如何解决这个问题的?

A:OpenAI让约1万个由内部未发布模型驱动的AI智能体集中攻克这一任务,仅用88小时就找到了解决方案。

Q3:为什么这次突破引发了争议?

A:因为OpenAI在得知其他研究者(如巴克曼和阿尔波格)正在研究相关问题后,仓促投入资源抢先完成,还涉及是否使用了他人数据、以及沟通中的不当言辞等争议,引发学界对学术信任规范被破坏的担忧。

The Verge