**OpenAI发布722篇AI生成的数学手稿,宣称解决超370个悬而未决的难题,其中黎曼猜想弱化版被数学家评价为“立刻拿菲尔兹奖”,但大量证明存在错误或无法验证,数学界反响两极。** **要点** **1. 核心成果含金量高** 黎曼猜想弱化版证明(实部大于7/8区域无零点)被罗格斯大学数学家评价“立刻拿菲尔兹奖”,平面染色问题被压缩至6或7种答案。 **2. 证明质量堪忧** 722篇手稿无同行评审,发布第2天撤回3篇,另有14篇修补;约42%通过机器检查,但部分机器验证结论与论文原题不对应。 **3. 数学界反应两极分化** 800多人组成的“人类数学协会”呼吁停止与OpenAI合作,20多位菲尔兹奖得主联名批评AI将难题当考题;也有学者认为“爬了一辈子,现在能飞了”。 **4. 学术生态遭冲击** AI直接端出答案使证明方法无法传承,数学家经费申请一夜作废;陶哲轩批评此举破坏露天开矿式的渐进研究模式。 **5. 研究负担转嫁学界** 弄清全部手稿预计需数年,OpenAI表示将继续发布,数学家只能“趁OpenAI还没抢在前面”加紧完成手头研究。
OpenAI倒了一座“屎山”,数学家正捏着鼻子在里面淘金
2026-10-10 20:12

OpenAI倒了一座“屎山”,数学家正捏着鼻子在里面淘金

本文来自微信公众号: 果壳 ,作者:Steed,编辑:Steed


今年夏天,王虹因为挂谷猜想的三维版本拿了菲尔兹奖。不到3个月,OpenAI说它的AI把四维版本也解决了。


10月7日,美国OpenAI公司在代码托管网站GitHub上一口气放出了722篇数学手稿。


它们出自同一个从未公开的内部模型,覆盖数论、几何、概率、理论计算机等17个数学分支。OpenAI说,模型一共尝试了约4000个悬而未决的数学问题,最后在372组问题上拿出了结果。平均每个结果耗费的算力,大约相当于ChatGPT付费高级版思考3个小时。


其中一项,被一位数学家评价为:如果是人做出来的,“立刻拿菲尔兹奖,没有任何疑问”。菲尔兹奖是数学界的最高荣誉,4年才颁一次。


可这722篇手稿,到现在还没有谁通读过一遍,OpenAI自己的研究人员也没有。


光是目录加摘要就有大约40页,有数学家从头翻到尾,花了大半个小时。接下来几天,各个方向的专家翻看自己熟悉领域的那几篇,陆续带出了坏消息:有的证明错了,有的根本读不懂,有的连机器检查都没做过。


有数学家形容,这是一大坨屎被倒在了自家门口。


偏偏这堆屎山里,很可能真有金子。


OpenAI宣称,在平面点集染色问题上取得进展丨Olena Shmahalo/Quanta Magazine


手稿里最好懂的,是平面染色问题。


给一张无限大平面上的每个点涂颜色,随便定一个长度当作1,要求任意两个相距恰好为1的点颜色不同,最少需要几种颜色?


这个问题1950年就有人提出,之后几十年,人们只知道答案在4到7之间。2018年,英国一位研究抗衰老的生物学家、业余数学家奥布里·德格雷(Aubrey de Grey)证明至少要5种。


这次OpenAI的模型声称,5种也不够,答案只剩6或7。


数学家黎曼和他提出猜想的手稿丨Jonathan Groß


分量最重的一项和黎曼猜想有关。


素数,也就是只能被1和自身整除的数,在数轴上分布得看似杂乱,背后却被一个叫黎曼ζ函数的东西控制着。这个函数有无穷多个零点,也就是让函数值等于0的位置,它们的排布决定了素数的排布。


数学家已经知道,除了一批位置早就清楚的零点,其余的全都落在一条带子里,用数学语言说,它们的实部在0到1之间。1859年,德国数学家黎曼猜测,它们其实整整齐齐排在带子正中那条线上,实部都等于1/2。


160多年过去,黎曼猜想没人证得出来,连退一大步的弱化版本也没人做到。只要能证明带子右边某一截完全没有零点就算成功,哪怕只是0.99到1之间那一窄条,人类也证不出来。


这次的手稿声称,实部大于7/8的区域里一个零点也没有。


美国罗格斯大学的数学家亚历克斯·孔托罗维奇(Alex Kontorovich)说的“立刻拿菲尔兹奖”,指的就是这一项。


这离黎曼猜想本身还差得远。猜想要的是1/2,美国佐治亚理工学院的马特·贝克(Matt Baker)提醒,完整证明可能需要完全不同的方法。


况且,这些结果眼下都还只是手稿上的声称。722篇手稿没有一篇经过同行评审,也没有人类作者署名。


第2天,OpenAI就撤回了3篇论文丨X截图


发布第2天,OpenAI就撤回了3篇。毛病出在第一篇里的一个符号上:该写负号的地方写成了正号,一步关键的抵消因此不成立。另外两篇建立在同一个构造上,跟着一起撤回。同一天,还有14篇做了修补。


更多的稿子,毛病出在读不懂。


美国布朗大学的布伦丹·哈塞特(Brendan Hassett)翻开自己最熟悉的那个问题,粗读一遍,觉得不知所云。他说,这要是人写的,他不会再多花时间,可后面还有721篇。


美国普林斯顿大学研究黑洞数学的米哈利斯·达费莫斯(Mihalis Dafermos)看了自己领域的几篇,挑不出具体哪里错了。它们写得太含糊,够不上证明的标准,连错都谈不上。


Lean是一个用代码写数学证明、并能由机器自动检查其逻辑严密性的交互式定理证明器丨viz-x/DEV Community


读不懂的证明,本来还可以交给机器。


数学有个别的学科没有的便利:证明可以翻译成Lean这类程序能读懂的语言,由计算机逐行检查。截至10月10日,约42%的结果通过了这种机器检查。其余的那些,OpenAI在说明文件里也承认可能有问题,撤回的3篇就在其中。


机器检查也有盲区。程序只能保证它拿到的那句话被证明了,这句话和论文里的原题是不是一回事,还得有人去读代码核对。负责Lean数学库的约翰·科梅林(Johan Commelin)就怀疑,有些形式化版本证明的其实是更弱的命题。


这几天翻稿子的数学家里,已经有人发现,机器验证过的那句话和论文里宣称的结论,看上去并不总能对上。


这样一来,哪篇是金子,哪篇是烂稿,只能靠人一篇一篇去读。


这个活儿,落到了整个数学界头上。


英国牛津大学的厄休拉·马丁(Ursula Martin)说,OpenAI这是扔给学界一份乱糟糟的初稿,再指望别人替它收拾。


菲尔兹奖得主陶哲轩公开反对并抵制OpenAI的论文轰炸丨David Esquivel/UCLA


放在过去,把证明讲明白,是拿出证明的人自己的事。


菲尔兹奖得主陶哲轩讲过数学界的惯例:一个长期难题被攻克后,证明者会到处做报告,同行组织研讨班一起啃,新的合作和新问题随之冒出来,年轻人被吸引进这个领域,证明被一步步简化,最后写进教科书。


现在,难题被AI成批解掉,提交结果的人自己也讲不清楚,这一连串反应几乎不再发生。研究者还开始把有前途的方向藏起来,生怕被抢先。陶哲轩把这比作露天开矿,把未解问题一片一片挖光。


有人干脆不接这个活。发布第2天,一个由800多名数学家组成的团体“人类数学协会”发表声明,呼吁同行停止与OpenAI合作。声明说,一次放出700多个文件,是在秀肌肉,算不上学术。


开口批评的不止这一个团体。9月,20多位菲尔兹奖得主就联名发表过宣言,批评AI公司把数学难题当成测试模型的考题。


他们担心的是答案背后的东西。数学家攻一道难题,路上会造出新方法,再靠报告、讨论和教科书传给后来的人。AI直接把答案端出来,没人消化,这些方法就传不下去。


年轻人已经先吃了亏。博士论文、经费申请、求职材料,往往就押在某一个未解问题上。手稿放出来之后,有数学家说,身边一批朋友和同事的经费申请一夜之间作废了。还有人担心,下一代要是不再啃难题,几十年后,这些数学可能就没人看得懂了。


OpenAI没有停下来的意思丨X用户@ℏεsam


数学界并没有达成一致。加拿大多伦多大学的丹尼尔·利特(Daniel Litt)认为,这对数学是好事,他转述一位合作者的感受:“我觉得自己爬了一辈子,现在能飞了。”也有人看到自己研究过的问题被解决,感到的是轻松。


兴奋也好,愤怒也好,摆在所有人面前的是同一堆稿子。数学家普遍估计,把这722篇弄明白,要花好几年。


OpenAI没有停下的意思。它表示会继续拿数学问题测试自己的内部模型,数学圈里也已经在传下一批手稿。


法国国家科学研究中心(CNRS)的数学家斯科特·阿姆斯特朗(Scott Armstrong)自认是对AI最乐观的那批人之一。被问到接下来的打算,他说眼下最要紧的是把手头的研究做完,“趁OpenAI还没抢在我们前面”。


参考文献


[1]OpenAI.Sharing AI progress in mathematics.2026-10-06.https://openai.com/index/sharing-ai-progress-in-mathematics/


[2]OpenAI.openai/math(手稿仓库,含说明文件与更新记录).GitHub.https://github.com/openai/math


[3]Robert Hart.‘Pure insanity’:Mathematicians will need years to make sense of OpenAI’s latest drop.The Verge,2026-10-09.https://www.theverge.com/ai-artificial-intelligence/1008726/openai-mathematics-solutions-chaos


[4]Peter Hall,Joseph Howlett.The most exciting claims from OpenAI’s heap of new proofs.Scientific American,2026-10.https://www.scientificamerican.com/article/the-most-exciting-claims-from-openais-heap-of-new-proofs/


[5]Davide Castelvecchi.OpenAI posts 700 maths preprints online:mathematicians are up in arms.Nature,2026-10-07.https://doi.org/10.1038/d41586-026-03196-8


[6]Cracks appear in OpenAI’s wall of proofs.Quanta Magazine,2026-10-09.https://www.quantamagazine.org/updates/transformation/


[7]Jeremy Kahn.OpenAI publishes solutions to more than 370 outstanding math challenges.Fortune,2026-10-07.https://fortune.com/2026/10/07/openai-math-controversy-solutions-370-outstanding-challenges-published-criticisms-celebration/


[8]Is this the‘mathocalypse’?Why OpenAI’s latest results dump has left mathematicians in shock.The Conversation,2026-10-09.https://theconversation.com/is-this-the-mathocalypse-why-openais-latest-results-dump-has-left-mathematicians-in-shock-293837


[9]A Severe Misalignment of AI in Mathematics(菲尔兹奖得主联名宣言).2026-09-11.https://mathandai.org/


[10]Association for Human Mathematics.Statement on OpenAI’s October 6 release of mathematical documents.2026-10-07.https://www.ahmath.org/statements

AI行业信号频道: 前沿科技
本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。
正在改变与想要改变世界的人,都在 虎嗅APP