25位菲尔兹奖得主联名质疑AI“剧透”数学,他们究竟在担心什么?
8月以来,美国Anthropic、OpenAI等AI企业凭借手中先进的大模型在前沿数学领域接连取得多项成果。Anthropic宣称研究版Claude模型在黎曼猜想上取得进展,其Fable模型仅用11天就完成了费马大定理的完整形式化证明。OpenAI则宣布GPT-6 Astra模型在有界素数间隔问题上取得新突破,其内部未公开模型仅88小时就解决了千禧年七大难题之一——纳维-斯托克斯问题。

视觉中国供图
然而,就在AI“狂飙突进”啃下一个又一个数学难题时,顶尖数学家们却举起了“警示牌”。9月11日,陶哲轩、邓煜等25位菲尔兹奖得主联名发布公开声明称,AI企业将攻克数学难题作为大模型性能基准的做法,对数学科学本身乃至整个数学界都造成了损害。
AI之于数学,究竟是解决难题的“神器”,还是带来伤害的“毒药”?数学界该如何应对AI带来的冲击,抓住AI带来的机遇?
完全依靠AI或将“污染”研究过程
数学家们在声明中写道,在许多领域和活动中,多年的训练不仅是为了得到最终答案或产品,更是为了培养理解力以及提出新问题和新想法的能力。
正如陶哲轩所说,在数学领域,大多数问题的提出并不是为了迫切得到答案,解决这些问题的过程会推动该领域进一步发展。他在社交媒体上用“剧透”形容AI企业对数学界带来的伤害——过早地完全依靠AI解决问题,可能会“污染”数学研究的过程,为数学的发展带来负面影响。
“很多数学难题的最终答案其实并不是这个难题最有价值的部分。”中国传媒大学数据科学与智能媒体学院副教授王传彪非常同意陶哲轩的观点。他告诉科技日报记者,经过350多年研究,费马大定理在1994年才被攻克,这段时间里人们绞尽脑汁寻找的破局方向、研究方法、数学工具比结果更有价值。
那么,AI在解决问题的过程中,会不会产生对数学有重要意义的“中间产物”?答案是,现阶段AI的表现还不尽如人意。
OpenAI号称解决了纳维-斯托克斯问题,并发布了长达166页的论文。布朗大学纳维-斯托克斯问题专家哈维尔·戈斯麦·赛拉诺认为,这篇论文不仅大模型生成痕迹明显、晦涩难懂,而且缺乏人机交互、思维链等重要的中间过程信息。8月,陶哲轩也在论文中提到,当前AI工具的解题过程相当不透明,那些内部运作机制属于企业机密的专有模型更是如此。
当然,AI对数学界的冲击并不止于“剧透”。北京大学北京国际数学研究中心博雅特聘教授董彬认为,AI可以大量生成候选证明和候选结论,但评估这些结果是否真正推进了数学理解,以及它们在知识体系中处于什么位置,仍然需要数学家来判断。因此,压力正在向评估和消化环节转移。
“如果候选结果的AI生成速度持续提高,评估和消化的工作越来越多,现有的学术评价机制就需要相应调整。这一点目前还没有很好的解决方案。”董彬说。
“AI正在导致数学界成果发表链条出现拥堵。”王传彪了解到,在某些具体方向上,大量使用AI获得的成果快速涌现,产出规模已远超审稿人同行评审的承载能力。同时,AI辅助研究也带来了公平性问题,AI工具的好坏、有无,使研究者不再处于同一起跑线上。
AI扩展数学家提出好问题的空间
AI应用于数学研究,带来的全是负面结果吗?答案或许并没有那么简单。
对于AI企业来说,用大模型破解数学难题,并非完全为了提高知名度或者抢数学家的“风头”,而是颇为符合技术逻辑的理性选择。
“数学是人类已知最精确的结构化推理体系,它恰好具备了一个对AI训练极为关键的属性——结果可以被程序自动验证。”董彬介绍,代码训练之所以能让AI变聪明,核心原因是它实现了结构化任务和自动反馈的闭环,简单说就是可以“做题—自动判分—改错”不断循环。数学把这套范式推向了更深的层级。以AI训练中常用的数学推理工具Lean 4中最大的数学库Mathlib为例,其概念依赖链深度可达84层,这种长链条推理是普通编程任务很少涉及的。
董彬总结道,AI企业选择用数学来训练和验证大模型,本质上是选了一个当前最干净的推理试验台,其根本目的还是提升模型能力。
AI在数学研究中的应用也给数学界带来了机遇。陶哲轩等数学家在声明中明确写道:“AI有望增强和加速真正的数学研究与理解。”
“机遇首先体现在数学家自己的日常研究中。”董彬说,学习一门自己不熟悉的数学技术,过去往往需要找到相应领域的专家当面请教,或者花很长时间从文献中摸索。现在借助AI,这个过程快了很多,跨领域学习的门槛正在下降。
王传彪对此也深有感触。他告诉记者,一个数学问题被人研究了上百年,可能完全进入了一个错误的研究路线,真正的解决思路反而被隐藏在其他数学方向中。事实上,很多被AI解决的数学难题,最后使用的方法也是早已被发现的数学工具,只不过这个工具属于其他研究方向。
“数学的概念空间极其巨大,已被人类探索过的部分只占很小一块。”董彬说,AI加速解决数学问题,不仅不会挤压数学家的空间,反而会打开新的结构和新的疑问,扩展数学家“提出好问题”的空间。
AI与数学家的关系仍待讨论
AI可以被用于数学研究,这没有什么争议。但应用AI到什么程度,既能加速数学发现、又能避免“剧透”,似乎还没有定论,不同数学家给出的观点也不尽相同。
“有正确思路、需要组织已有技术沿着思路快速推进的数学问题,特别适合AI来‘暴力’破解。但没有思路、需要构建新的数学框架,或者核心工具缺失的问题,AI现在还搞不定。”在董彬看来,数学研究中真正稀缺的能力从来不只是解决问题,而是提出好问题、判断什么方向值得走。这目前仍然主要依靠人的判断。
例如,OpenAI在公告中刻意突出大模型、智能体在证明纳维-斯托克斯问题上的作用。但事实上,这一过程中无论是目标题目还是解题路线的选择,都是数学家团队作出的决定。
今年5月,菲尔兹奖得主阿克谢·文卡特什等学者发文称,AI正在重新定义数学学科的本质,并鼓励所有读者积极参与AI与数学的话题讨论。9月,陶哲轩在社交媒体上称,为了维护某些数学问题对数学生态系统的更广泛价值,或许有必要禁止AI处理某些类型的数学问题。
董彬赞成数学界应对使用AI的规则开展广泛讨论。他倾向于讨论的落点聚焦于研究成果的评价标准上,而不是先去划定哪些问题不许用AI。
“是否限制AI的使用要分两种场景谈。”董彬说,数学教育领域的限制是必要的,AI不能代替学生完成思考。在科研领域,评判研究的标准则要看其是否推动了数学的进展。至于研究者用了什么工具并不是关键,但透明是必要的,用了AI就要在论文里如实说明用在哪一步、起了什么作用。
最近,OpenAI首席执行官萨姆·奥尔特曼公开宣布,该公司内部模型能够做到世界上最顶尖数学家都无法做到的事。看来,关于数学与AI之间的讨论,还会持续下去……
(原标题为《菲尔兹奖得主质疑AI“剧透”数学的背后》)
(本文来自澎湃新闻,更多原创资讯请下载“澎湃新闻”APP)
上一篇:人類最基本的道德是什么?
下一篇:道德,是人類最重要的財富嗎?
大家都在看
-
未来卡住人类脖子的, 可能根本不是芯片, 而是人类挖了几千年的铜! 当所有人都在为台积电量产两纳米芯片的良品率欢呼时,北美的几座百兆瓦级AI数据中心却正面临无限期延宕。不是因为抢不到英伟达的GPU,而是买不到足够的高压变压器和特高压输电线缆。人类试图用最尖端的量子力学重塑 ... 人类之最09-22
-
当天跑路的菲奖得主:AI杀死全人类的五大路径 ► 文 观察者网心智观察所 2026年7月23日,38岁的加拿大数学家雅各布·齐默尔曼接过了菲尔兹奖奖章。颁奖仪式甫一结束,他就在记者会上宣布跑路,离开数学界,转投OpenAI的安全部门。事实上,齐默尔曼已不再招收研究 ... 人类之最09-22
-
道德,是人類最重要的財富嗎? 世人终其一生,皆在追逐财富。有人执着于金银钱币的积累,有人沉迷于名利地位的攀升,也有人渴求名望荣誉的加持。可当我们拨开世俗财富的浮华表象,回望人性与社会的本质,便会得出笃定的答案:道德,是人类真正无可 ... 人类之最09-22
-
25位菲尔兹奖得主联名质疑AI“剧透”数学,他们究竟在担心什么? 8月以来,美国Anthropic、OpenAI等AI企业凭借手中先进的大模型在前沿数学领域接连取得多项成果。Anthropic宣称研究版Claude模型在黎曼猜想上取得进展,其Fable模型仅用11天就完成了费马大定理的完整形式化证明。Open ... 人类之最09-22
-
人類最基本的道德是什么? 世间礼法千条、美德万种,忠诚、勇敢、善良、感恩皆为人称颂的品行,但剥离所有华丽的道德外衣,褪去文明赋予的条条框框,人类最基本的道德,从来不是高尚的奉献与无私的牺牲,而是心存敬畏、懂得共情、守住底线的善 ... 人类之最09-22
-
人类史上最恐怖的工业巨兽:中国的产能到底有多逆天,工业克苏鲁 这几年网上许多人把中国称为“工业克苏鲁”。一开始不少人反感——好好的工业实力,为什么非要套一个陌生的西方词?但用久了才发现,这个比喻实在是妙。克苏鲁不是拿来让人理解的,是拿来让人恐惧的。搜再多资料,我 ... 人类之最09-21
-
最适合人类的食物竟然是土豆?营养全面到不可思议! 大家好我是生活杂谈,每天给大家带来最新动态 ,内容随缘更,每篇都掏干货;如果你觉得这些信息对生活有用,就点个关注~生活里有一种特别神奇的食材,家家户户的厨房里基本都常备,价格低廉、存放简单、做法百搭, ... 人类之最09-21
-
小艾:人类历史上第一部以客观存在为根基的存在论哲学 在人类思想发展的长河中,"存在"始终是哲学的终极核心议题。从古至今,无数思想家不断追问"何为存在",却始终没有建立统一、明确的判定标准,致使西方各类存在论体系长期分立、各执一端,衍生出大量 ... 人类之最09-21
-
被童年抛弃,被时代封神:牛顿,用一生偏执点亮人类科学的黎明 在人类璀璨的科学星河中,有一颗永不坠落的巨星,他孤身穿越愚昧的黑夜,用理性拆解天地万物的密码,用公式定义宇宙运行的规则。他就是艾萨克·牛顿,一个被命运亏欠童年,却倾尽一生馈赠世界的天才。世人熟知他被苹 ... 人类之最09-21
-
人类对抗"被孙哥割韭菜"的方法找到了: 解开数学难题, 孙哥钱分你! 华人币圈的“流量天花板”孙宇晨,又搞出了核弹级的跨界大动作。这次他不拍天价香蕉,不上天玩太空旅行,也不请巴菲特吃午饭了,而是高调设立了“孙宇晨奖”(The Justin Sun Prize),一口气公布了首期66个获奖数学 ... 人类之最09-20
相关文章
- 看完这3件小事才懂:为什么狗狗,是人类最纯粹的朋友
- 万亿美元外贸顺差,坠向中等收入陷阱
- 人类史上最强数学全才!欧拉:凭一己之力,撑起近代数学百年格局
- 全网都被骗了!中俄伏尔加河连通长江,根本不是超级运河
- 人类怎么"活"?两千多年前,这两人给出一样的答案
- 人类历史水平最高的400米比赛,范尼凯克打破世界纪录夺冠!
- 中国七大超级工程!每一项都曾被国外判定为“不可能完成”
- 金钱是人类发明最伟大的自由工具,金钱会向穷人开放,而权力不会
- 牛顿有多恐怖?一个从小没人疼的孩子,最后却改写了整个人类世界
- 原子弹炸后百年内寸草不生,今广岛却住满了人,看看专家怎么说?
- 同时代诞生的世界名人:尼罗河畔的创世众神故事
- 猫骨灰里挖出钻桩:一桩婚变,以这种方式被宠物殡葬师揭穿
- 国家在武汉布下惊天大局,瞒不住了!武汉真正的王牌正在悄悄崛起
- 当代都市人的新晋运动目标,去山里“备战奥运”
- 全程无麻药割眼72刀!刘伯承强忍剧痛数针,震撼德国医生
- 勇做时代先锋 汇聚团结力量——习近平主席赴印度新德里出席金砖国家领导人第十八次会晤纪实
- 人类史上最强天才,横跨数学物理两界,阿基米德到底有多恐怖
- 鸿蒙大一统理论:人类认知的三大致命误区
- 从长征精神中汲取强军兴军力量
- 诺曼底登陆:为什么被称为“人类历史上最伟大的登陆战
热门阅读
-
关于男人的15个世界之最,最长阴茎达56厘米 07-13
-
东方女性最标准的乳头(图片),看看自己达标吗 07-13
-
人体器官分布图介绍 五脏六腑的位置都在哪 07-13
-
木马刑是对出轨女性的惩罚 曾是满清十大酷刑之一 07-13
-
熙陵幸小周后图掩盖性暴力 至今保存于台湾博物馆 07-13
-
包头空难堪称国内最惨案件 五名遇难空姐照曝光 07-13
-
中国十大不公开事件,双鱼玉佩事件上榜 12-11
-
2022中国最新百家姓排名,你的姓氏排第几? 03-26
