OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧

The Verge:AI(RSS)·2026-08-11 19:00·40天前·Robert Hart
AI 导读

OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。

The Verge:AI(RSS)
精选
75AI 编辑部评分,满分 100

OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧

2026-08-11 19:00· 40天前· Robert Hart
AI 导读

OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。

推荐理由

这篇报道将10个数学问题的AI解法置于数学界的就业恐慌、商业侵蚀和归属争议之中,展示了技术突破如何引发学术生态的连锁反应。

正文 · AI 翻译

OpenAI 展示了 AI 能够攻克数学领域长期悬而未决的问题。专家们对由此带来的可能性感到兴奋——同时也担忧这对他们所在领域接下来意味着什么。

268684_OpenAI_claims_to_revolutionize_maths_CVirginia2 268684_OpenAI_claims_to_revolutionize_maths_CVirginia2

过去一年里,数学家 James Maynard 花了大量时间“自我反思”。作为牛津大学教授、享有盛誉的菲尔兹奖得主,Maynard 告诉 The Verge,随着这门传统上进展缓慢的学科匆忙适应 AI,他一直在思考自己领域的未来。

在我们交谈的几天前,OpenAI 披露它已给出 10 个长期悬而未决的数学问题的解答,其中一些问题困扰了学术界数十年。就像生成式 AI 被用于生成文本和图像,或在科学医学领域提出构想一样,这项技术从其训练所用的大量材料中学习模式和关联,并利用它们创造出新的东西。应用于数学时,这可能意味着以新的方式组合已知的结果、方法和工具来攻克一个问题,有时在不同领域之间建立联系,或让埋没在学术文献中的概念重新浮现。

对于 Maynard 和其他接受 The Verge 采访的数学家来说,这一消息让他们对本领域走向的复杂情绪更加翻涌。对于加速数学发现的前景,人们有着显而易见的兴奋——但也有忧虑,某些情况下甚至是绝望,因为他们担心这对那些毕生致力于这一追求的人,以及将追随他们的未来一代代数学家意味着什么。很少有人怀疑,一场深刻的剧变已经在进行之中。

OpenAI 使用一款名为 Astra 的未发布先进模型所解决的问题,横跨了广泛的数学领域,从高度抽象的问题到具有实际意义的问题。其中一项突破涉及球体在三维以上空间中能有多紧密地堆积,这个问题与数据能被多高效地编码和传输相关。另一项突破推进了纠错码的极限,纠错码有助于从含噪信号中恢复信息。第三项突破解决了两个长期悬而未决的问题:复杂连通网络在结构性模式出现之前能变得多复杂。清单上的其他成果还攻克了量子博弈论中的问题,以及在后量子网络安全所用技术中具有意义的高维网格内目标搜索问题。

其中最引人注目的成果之一,涉及非 sofic 群的存在性——这类无限数学结构,粗略地说,无法用有限结构来近似。这类结构究竟是否存在,几十年来一直是一个悬而未决的问题。它引人注目还有另一个原因:围绕功劳应归于 OpenAI 的 AI 多少、又应归于其近期工作所依托的人类数学家多少,存在一场争议。

剑桥大学数学家 Francesco Fournier-Facio 告诉The Verge,他和该领域的其他人认为,OpenAI 最初的公告淡化了研究人员 Andreas Thom 和 Gábor Kun 的贡献,而他们近期的研究为这一成果奠定了基础。

当 OpenAI 首次发布其公告时,它表示分享的是“针对那些长期悬而未决、且主要结果至少十年、多数情况下远不止十年毫无进展的问题所取得的成果”。它后来修改了这一说法,改为分享“各项成果,每一项都解决了一个长期悬而未决的问题,或在其上取得了实质性进展”。该页面没有更正说明,也没有对这一改动做出任何解释。

Kun 是匈牙利阿尔弗雷德·雷尼数学研究所的研究员,他告诉The Verge,OpenAI 在发布前不久通过电子邮件联系了他,向他分享了其发现。他认为最初公告中那种笼统的措辞“相当滑稽”,尤其是所附的更详细研究论文“明确表示它建立在我 2016 年和 2019 年的成果之上”,后者是与 Thom 合著的。“这相当草率,”Kun 说。

发布之后,OpenAI 再次联系了 Kun。他拒绝分享完整的邮件往来,但向The Verge朗读了他所说的其中一段摘录,其中一位 OpenAI 数学家写道,那段措辞本意是指该合集里的其他成果。“它并非意在暗示这个问题没有任何进展,”他说,邮件中这样写道。“我们当然同意,这一论证关键依赖于你的工作。”这位数学家还补充说,他们会要求修改公告的措辞。

OpenAI 发言人 Laurance Fauconnet 向 The Verge 证实,该帖子随后进行了更新。“我们更新了措辞,以更好地反映这些结果所基于的先前研究。尽管非 sofic 群是否存在这一问题数十年来一直悬而未决,但我们的 sofic 群证明依赖于更近期发表的重要数学工作,我们希望确保这些贡献得到恰当的认可。”

Kun 表示,他怀疑其他结果中是否也存在类似的疏漏,而那些结果超出了他的专业领域。

更广泛地评估 OpenAI 的这些结果并非易事。数学已经变得如此专业化,以至于很少有研究者具备充分的能力去审视 Astra 所触及的所有领域。该公司发布了超过 250 页论文来阐述这些解答,另有 60 多页描述“这些想法是如何汇聚而成的”,并用 Lean(用于验证数学证明的软件)对每一项结果进行了认证。尽管 The Verge 采访的许多数学家表示,他们个人无法评估其中部分甚至全部解答,但所有人都表示,普遍共识是 OpenAI 的这一成就背后似乎确有实打实的分量。

这些问题——OpenAI 声称由其“下一代主要模型”Astra 的内部版本解决——绝非等闲。Maynard 表示,它们是数学家和计算机科学家曾投入大量时间思考、却屡屡未能解决的那类问题。

“人们普遍觉得,[解决]这 10 个问题中的任何一个都能让你在学术界找到一份工作,”伦敦数学科学研究所研究员何杨辉(Yang-Hui He)说。他刚从韩国一场为期四周的 AI 与数学研究会议回来,他说,许多人感到过去六个月里出现了一种“相变”,AI 带来了真正而有意义的进展。

今年 5 月,OpenAI 震惊了数学界,它宣布,一个未具名的内部模型破解了 Paul Erdős 提出的一个猜想,而这个猜想在近一个世纪的大部分时间里一直困扰着数学家。7 月,哈佛大学数学家 Levent Alpöge 发推称,Anthropic 的 Claude Fable 5 用一个微小的反例推翻了棘手的雅可比猜想,颠覆了数十年来试图证明其为真的努力。这些只是数学家们真正在意的问题被 AI 攻克的最新例子。

Maynard 回忆说,直到最近,情况并非总是如此。他说,除了一些值得注意的例外,AI 在数学领域的突破往往伴随着大量宣传,而所涉及的问题却常常很少受到研究者的认真关注。这种变化的速度让许多研究者措手不及,整个领域正忙于思考如何应对,一些人则在怀疑,它是否还能以任何接近当前形态的方式继续存续下去。

许多接受 The Verge 采访的数学家似乎仍在消化自己对这一切的看法,同时表达了对变化速度的惊讶,甚至是震惊。兴奋之情溢于言表,但他说,从韩国的那场会议以及更广泛的领域来看,他的印象是,领域内许多人在淡化近期进展的重要性,以求对事情推进的速度“保持冷静”。

金钱是许多这类担忧的核心。“目前还不太清楚我们的大学是否愿意为我们的定理支付那么高的费用,”苏格兰圣安德鲁斯大学的教授 Colva Roney-Dougal 说。“数学通常是一门廉价的学科,”她说,指了指一块写满她研究内容的白色书写板。“大多数时候我甚至懒得去申请研究经费。我不需要。我只要继续做我的工作就行。”

即便按照 AI 的标准这些成本相对不高,这套体系也可能崩溃。OpenAI 估计,按照其 Sol 模型当前的 API 价格,生成 Astra 的 10 个解答大约要花费 2,000 美元的 token 费用。接受 The Verge 采访的研究人员表示,真实成本很可能要高得多,具体取决于在成功之前尝试了多少问题和多少次尝试。当被问及最终名单是如何汇总而成时,OpenAI 没有详细说明。但对于一个习惯于靠微薄预算运作的领域来说,即便是公开标出的价格也可能过于高昂。Roney-Dougal 担心,规模较小、财力较弱的机构的研究人员可能会被完全挡在某些研究之外。

还有一种更广泛的不安,即商业利益正日益侵入一个基本上一直公开运作的领域。尽管数学已变得更加依赖计算,但研究人员所依赖的许多工具都是开源且可免费获取的。而 OpenAI 和 Anthropic 等公司最强大的模型是专有的,访问权限由这些公司严格控制。虽然两家公司都有项目为学术研究人员提供免费访问权限,但这种访问远非普遍,而且The Verge采访的研究人员中,很少有人能够使用最先进的系统。Maynard 和 Roney-Dougal 都表示希望开放权重模型最终能够弥合这一差距,让数学家无需依赖少数几家大型 AI 公司就能获得工具。

访问权限并不是唯一的担忧。The Verge采访的多位研究人员质疑,AI 公司的价值观是否与数学界的价值观一致。他们说,这些公司有产品要卖,还要为即将 IPO 所对应的巨额估值提供支撑,因此它们有充分的动机去炒作和夸大自己的贡献,同时贬低这些成果所依赖的人类学术工作。

“这是目前我最不满的一点,”Roney-Dougal 说。“他们把我们的学科当成了广告游乐场。”

这些担忧并不局限于 The Verge 采访过的研究人员。今年 6 月,数学家们发布了 《莱顿宣言》,这是一套关于在数学中负责任地使用 AI 的原则,已获得国际数学联盟的认可,并有超过 3,400 人签署。它敦促政策制定者、政府、媒体和其他群体不要轻信那些“夸大其产品能力”的公司所制造的“炒作”。人们担心的是,夸大的说法将对该领域产生切实后果,让资助方和政府相信人类数学家的必要性比实际上更低。

OpenAI 被指责在其 10 项 Astra 进展中正是这么做的,尤其是因为它淡化了 Kun 和 Thom 的贡献。Kun 说他的“感受相当矛盾”。看到自己的工作被证明有助于解决一个重要问题,这令人欣慰,尽管他希望完成它的人是自己;这也给他带来了原本可能永远不会得到的关注,以及大量的祝贺。他对祝贺者的玩笑是:他将成为一个“非常著名的失业者”。

Fournier-Facio 的感受则远没有那么矛盾。他说:“大多数人只会看看 OpenAI 的公告,然后照单全收。”他认为,很少有人有时间、专业知识或意愿去翻阅数百页的技术论文,弄清标题背后的人类劳动,尤其是那些需要快速出稿的记者或政策制定者。“

他们只是在选择对自己最有利的叙事,”他说。“说一个 AI 系统独立想出了人类 10 年来毫无进展的东西,要唬人得多。说这是在过去 10 年人类想法的基础上,用一种聪明的方式把它们组合起来,就没那么抓眼球了。”

Fournier-Facio 承认,数学界在如何分配功劳这件事上,本身就存在不公平。“走完最后一步的人拿走了大部分功劳,对吧?”他把数学研究比作建造一座金字塔,在最终放下最后一块石头的人之下,是几代人积累的工作。他说,如果解决这个问题的是人类,也许就不会有这么多人坚持要确保 Kun 和 Thom 得到署名。但如今是 AI 迈出了最后一步,他担心其他所有人都会被错误地“视为无用”。

更糟的是:“在人类的情况下,放下最后一块石头的人未必会抢走所有建造金字塔者的饭碗。”

当数学家们思考 AI 将如何影响下一代研究者时,这种恐惧尤其令人不安。牛津大学教授 Andras Juhasz 表示,大语言模型开始解决的许多问题,恰恰是研究生“通常会研究”的那类问题。它们并不总是特别引人注目,但钻研这些问题对于培养成为一名成功研究者所需的技能、直觉和习惯至关重要。苏黎世联邦理工学院研究员 Johannes Schmitt 表示,他们现在面临的风险是,被别人用 AI 抢先一步解决掉。

这种影响已经开始显现。Juhasz 表示,随着 AI 系统越来越有能力完成项目作业,它对于本科生来说已经“成为一种有问题的评估形式”。这些工具或许能帮助学生更快得到答案,但可能损害通过挣扎求索才能获得的整体数学理解。与此同时,Maynard 已经在担忧如何让学生的研究项目面向未来。“如果一篇可发表论文的标准是 AI 做不到的事情,尤其是当博士通常要读四年时,你要找的不是一个 AI 现在做不到的问题,而是 AI 四年后做不到的问题。”

这种不确定性已经在固化为绝望情绪,尤其是在职业生涯早期的数学家中。“与我交谈过的许多人真的、真的非常害怕,”Fournier-Facio 说。他向 The Verge 指出了两篇绝望的文章,出自在网上流传的研究生之手,质疑自己在该领域的前途。Roney-Dougal 说,她在社交媒体上也看到了类似的疑虑在蔓延,评论大意是“我不确定现在该做什么。我不知道自己继续下去还有什么意义。”Roney-Dougal 本人没那么悲观:“我对此没那么沮丧,”她说。“但很多人是的。”

问题不止于 AI 能解出多少道题。数学的进步不是靠把问题从清单上一条条划掉来实现的。一个解答最重要的意义可能在于它引出了什么。最好的成果能开辟出全新的问题、技巧,甚至研究领域。AI 能否做到这一点,尚待观察。反过来说,现在就断言落入 AI 之手的问题不过是唾手可得的低垂果实,也为时过早。要充分理解这些成果贡献了什么、它们最终被证明有多重要,还需要时间。

到目前为止,Schmitt 并不信服。他说,他几乎没有看到证据表明 AI 的重大贡献能像这样开辟出新的思考与探索领域,这引出了一个令人不安的前景:这项事业正变得越来越失衡。“我们可能正走向一种有些失衡的局面,大量优秀而有趣的问题被 AI 智能体横扫,”他说,而这些解答并不会反过来为研究者催生出富有成果的新方向。

并非所有人都如此不安。伦敦研究所的 He 对接下来会发生什么出奇地乐观。他表示,从事传统学术数学研究的人数出现一定程度的收缩,甚至可能是一个“健康的方向”,并指出数学专业毕业生本就面临严峻的就业市场。另一些人则看到了 AI 拓宽研究参与人群的潜力,让那些无法接触到集中在精英机构的专业知识的本科生和研究人员也能发展自己的想法,并有可能产出此前可能遥不可及的、可发表的研究成果。

而对于资深研究人员来说,与此同时,将更多常规工作交给 AI,可以腾出时间专注于数学中更具创造性和概念性的部分。

尽管有这些恐惧与希望,没有人知道这一切将走向何方。AI 发展得太快,而它所产出的数学成果还太新,无法判断其影响可能是什么。几位研究人员担心,在任何人还来不及理解 AI 究竟意味着什么之前,关于 AI 可能成为什么的种种宣称,就可能让这个领域朝着更糟的方向被重塑。

当被问及他是否认为 Astra 的任何成果配得上菲尔兹奖——数学界最高荣誉之一,也是他本人四年前获得的奖项——Maynard 表示,他的初步印象是这些成果还不够格。

“我看过的那些,确实有着非常令人印象深刻的成果的气质,”他说,但未必是那种在概念层面提升数学的成果。他表示,就目前而言,他看到的更多是现有技术和方法被进一步推进并以巧妙方式相互连接的证据,而非某种深刻的新数学思想。

“但我觉得现在下结论也为时过早,”他说,“有时候需要时间和视角才能意识到,‘哦,这里确实有一个根本性的新想法。’”

以目前的发展速度,AI 可能不会给数学家们太多时间去弄清楚这一点。

来源:The Verge:AI(RSS)· theverge.com