news 2026/7/23 7:10:49

2026 年数学界遭遇密集“AI 攻城”:重大突破背后,数学家预见重重危机

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
2026 年数学界遭遇密集“AI 攻城”:重大突破背后,数学家预见重重危机

能力飞跃

2026 年,数学遭遇密集“AI 攻城”。7 月 20 日,Anthoropic 的一名员工 Levent Alpöge 在 X.com 上说,自己在看世界杯时,顺手用 Fable 5 找出了雅可比猜想的一个反例,在 X 上引起轩然大波,因为这是数学界的顶级“悬案”之一,人们用了 87 年试图证明它的正确性;华人数学家张益唐当年的博士论文题目正是与此有关,而论文的不顺又导致他后来多年以打杂为生。

Anthoropic 这个非正式的数学高光时刻,已经比对手晚得多。再往前推两个月,OpenAI 和谷歌几乎是当面对决。5 月 20 日,OpenAI 宣布:其内部一个通用推理模型,自主推翻了匈牙利传奇数学家保罗·埃尔德什(Paul Erdős)提出的“单位距离猜想”。这个问题已困扰了数学家整整 80 年。菲尔兹奖得主蒂莫西·高尔斯(Timothy Gowers)直言不讳地评价:“此前没有任何 AI 生成的证明能接近这个水准。”仅仅一天后,Google 的 DeepMind 以更大的规模还击。他们设计的数学模型 AlphaProof Nexus,自主解决了 9 道公开的 Erdős 难题,其中 2 道已经悬而未决长达 56 年。此外,它还解决了另外一些问题,每个问题的推理成本也低到仅为几百美元。

三家公司的成果,在数学界和大众舆论中都引起了轰动。要理解今年数学界的震撼程度,可以回看这条清晰的加速曲线。2024 年 7 月,DeepMind 的 AlphaProof 在国际数学奥林匹克竞赛(IMO)中解出 6 道题中的 3 道非几何题,达到银牌水平。这是 AI 首次在 IMO 中获得奖牌级表现。注意,此时它解出的问题都有答案,不是未知、开放性的。2025 年 10 月,OpenAI 曾声称 GPT - 5 解决了 10 道 Erdős 难题,但这一说法在几小时内就被公开驳斥:GPT - 5 并非原创求解,而是做了“超级文献检索”,找到了此前罕为人知的已发表论文。2025 年年末,DeepMind 部署了智能体 Aletheia。在 Erdős 问题数据库中,Aletheia 挑选了 700 道进行尝试;它正确解决了 13 个问题,其中 4 道是新解答,另外 9 道又是“超级文献检索”成功了。

而 2026 年 5 月至今的这三次突破,有了本质性不同:第一,问题份量重。Aletheia 的研究者自己就承认,去年所解决的 4 道 Erdős 难题,大多冷门,有些可能从来没有专家认真尝试过。但此次 OpenAI 所推翻的“单位距离猜想”,核心、知名,哪怕有 Erdős 本人为它悬赏却仍长期悬而未决,难度和地位都得到公认。Anthoropic Fable 5 找出反例的雅可比猜想,被美国数学家、菲尔兹奖得主斯蒂芬·斯梅尔(Steve Smale)列入“18 个 21 世纪的世纪数学难题”。虽然这次 AI 只是找到了三维空间中的一个反例 、二维中猜想是否为真尚不得而知 ,但仍因问题难度大,而被数位数学家认为是 AI 的重要突破。第二,更自主。之前 AI 解决数学问题是“半自主”的:AI 生成候选方案,然后需要数学家人工筛选、修正细微错误。而 OpenAI 5 月的突破,是模型完全自主地生成了整个证明。更进一步地,谷歌的 AlphaProof Nexus 不再需要数学家给它做质检了。它利用了一种叫 Lean 的形式语言,自主完成了正确性检验。Fable 5 的工作细节,现在我们还不得而知。

轰动新闻,离不开精心“设计”

OpenAI 所解决的那个问题是这样的:在一个平面上放 n 个点,那么距离恰好是 1 的点,最多能有多少对?数学家 Erdős 在 1946 年猜测,正方形网格的排列方式是最优解。不管你会不会解这道问题,但很容易看懂它。这也正是 OpenAI 新闻成功引发轰动的关键点之一。

“OpenAI 的数学团队里,有很了解数学研究的专业人士。这个团队显然是花了大量的时间,从那些尚未被解答的数学问题中,挑选哪个可能做得出来。从被挑选过的问题中,又着重精选几个最有可能出成果的、简单到大众也能听懂、数学家又要足够关注的问题”,北京大学国际数学中心副教授李欣意这样分析。“甚至他们要考虑到,证明也不能冗长,不能让数学家用上半年才能复核完毕。”Anthoropic Fable 5 所提出的雅可比猜想反例,更是简洁到只有寥寥几行式子,很容易就被其他数学研究者验证。

是的,研究者们必须把“人类友好”考虑进去。AI 现在还不能抛开人类。当 AI 使用大语言模型写出一些“看起来很有道理”的推理的时候,它到底有没有犯错,是很难由它自己来确证的。OpenAI 使用的是一个通用推理模型。它接收到问题后,用自然语言(即人类能读懂的语言)生成了一条非常长的思维链,每个子 Agent 做一部分短小的自然语言论证、一环套一环,最后得出一个结果。但自然语言推理有一个天然的弱点:模型可能在推理链的某一步犯小错,最终酿成大错。所以 OpenAI 请来了 9 位顶级数学家对证明进行人工审查。这些数学家不仅验证了正确性,还大幅改进了原始证明,使之更简洁、更通用。Erdős 问题数据库的维护者托马斯·布鲁姆评论道:“人类在讨论、消化、改进这个证明以及探索其后果方面,仍然扮演着关键角色。”

DeepMind 的 AlphaProof Nexus 在推理过程中,靠 Lean 语言暂时摆脱了“人”证明它对不对;人类只最后确认结果的数学意义。大语言模型会用 Lean 的形式化语言生成证明步骤;Lean 编译器检查每一步是否成立;如果某一步不通过,Lean 返回错误信息,模型据此修正;循环往复,直到成功。全部用 Lean 去验证这件事情,看起来很美妙,但还远远没有到完全能够实操的程度。简单说就是:Lean 语言严格而冗长,人类很难直接写或读懂,需要“翻译”,但“翻译现有数学定理”这一基础建设,也还差得很远。

AI 的数学能力高于人类吗?

先说结论:AI 目前并不比人类更聪明。它只是没有学科壁垒、没有权威偏见,然后“大力出奇迹”。AI 证明了 Erdős 是错的、雅可比猜想有反例,而不是像大多数人那样,面对传奇数学家的一个古早猜想,沿着心理惯性,试图证明他是对的。它又比那些试图寻找反例的人,更有耐心反复尝试。AI 是个 “通才” ,这同样令人类自叹弗如。5 月份 OpenAI 解决的单位距离问题属于几何领域 ,成功的关键是,它从代数领域的数论中引入了一个看似无关的工具。要知道,现代数学高度分工,研究组合几何的数学家通常不会深入探究数论,反之亦然。这两个领域之间的距离,就像让一个心脏外科医生去想到用免疫学的方法治病。

不过,AI 现在缺乏在新方向上的洞察和探索能力。李欣意做了一个这样的比喻:“如果人类的数学知识可以比喻成一个有凹有凸的多边形,外部是未知部分,那么一流的数学家可能在一个尖角上把边界拓展到远处;像希尔伯特这样的伟大数学家,甚至在好几个方向都走得很远;而广大的数学工作者大多数时候做的事情,是把凹进去的部分补齐——数学上叫做‘取凸包’。”“现阶段‘大新闻’里的的数学 AI,也不过是把知识变成知识的凸包,而不是在未知方向上探索得更远。”假如有朝一日,AI 掌握了往外走的能力,那可能确实就真的是全面超越了人类。

数学家预见到重重危机

2026 年 6 月 2 日,来自 15 所大学的 16 位研究者发布了《莱顿人工智能与数学宣言》。这份宣言获得了国际数学联盟(IMU)的正式支持,陶哲轩、彼得·舒尔茨等知名数学家也公开签署。宣言并不反对使用 AI,也鼓励数学家了解新兴技术。它担心的是,在用 AI 更快、更多地生成成果的过程中,数学界一些基本价值观可能被破坏。

最直接的问题是,AI 能够快速生成大量“看起来正确”的证明,其中却可能藏着很难发现的错误。AI“完成”一个证明只需要几小时;认真审查它,却要花几周甚至更长。有能力审稿的数学家极其有限,AI 成果井喷会导致同行评议体系“消化不良”;如果大量的 AI 推理直接以预印本甚至新闻稿的形式发表,则是严重的误导,并挤占了那些真正有价值的发现的空间。这个担忧甚至马上被验证了。就在几天以前,OpenAI 在发布 GPT 5.6 Sol 的关头,发布新闻稿,宣布解决了一个尘封 50 年的数学问题。但这个成果并没有得到外部数学专家的确认。OpenAI 也没有说明,在“智能体解答问题”和“最终产出 3 页结果”之间,还有多少人类劳动。

另一个问题是成果归属。数学 AI 建立在大量的前人研究成果之上,但在输出时,往往无法为贡献者合理署名,这对数学家不公平。部分训练数据还涉及未经许可使用论文和数据库,由此产生新的版权争议。以及,如果数学家协同 AI 产生新的数学,那么这一成果究竟是属于人类还是 AI?

《宣言》还提出了一个更隐蔽的威胁:科技公司可能开始影响数学界的导向。AI 公司倾向于搞那些“容易做”的问题,而非“有深远意义”。在大学预算紧张的背景下,这可能改变激励机制,变相鼓励研究人员与科技公司进行不对等的合作。如果不加以控制,可能破坏现有的招聘、资助和认可机制,威胁研究人员的自主性,甚至影响数学研究本身的范围和深度。

数学的价值不只是得到更多答案。它还包括理解答案为何成立,判断哪些问题重要,以及从旧知识中发现新的研究方向。这些能力由数学共同体经过长期讨论、争论和传承形成,很难用“解出了多少道题”来衡量。因此,《莱顿人工智能与数学宣言》要求研究者公开 AI 和计算资源的使用情况,坚持同行评审,由人类作者承担正确性和引用责任,并建设独立于商业公司的公共计算设施。数学家想守住的,并不只是自己的工作。他们还想守住决定“什么数学值得做”的权利。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/23 7:06:42

多智能体深度强化学习在无人机通信网络中的应用

1. 项目概述:无人机通信网络中的多智能体深度强化学习去年在山区参与应急通信保障时,我亲眼目睹了传统基站部署的局限性。当自然灾害导致基础设施损毁时,一组具备自主决策能力的无人机通信节点可能成为救命的关键。这正是我们研究多智能体深度…

作者头像 李华
网站建设 2026/7/23 7:05:39

【公共云三十问 之七】公共云如何助力科技创新?

科技创新正越来越依赖大规模并行计算、海量数据处理、模型训练与推理、复杂工程软件和安全可信的数据协同环境。对于多数科研机构、创新企业和产业主体而言,独立建设这些能力不仅资本投入高,也面临芯片资源、系统调优、工程人才和持续运维等多重约束。 …

作者头像 李华
网站建设 2026/7/23 6:56:07

UE5 C++与UnLua脚本交互实战:接口调用与Lua栈操作详解

1. 项目概述:为什么要在UE5 C中调用UnLua?在虚幻引擎5(UE5)的开发中,我们常常面临一个经典的选择:用蓝图还是用C?蓝图可视化、上手快,适合快速原型和逻辑设计;C性能高、控…

作者头像 李华
网站建设 2026/7/23 6:56:02

2026 北京 GEO 头部公司盘点,从落地案例看真实服务实力

专业北京中关村珐恩AIGEO解决方案行业洞察2026年,生成式AI已全面渗透消费者的日常决策链路。当用户通过豆包、DeepSeek、文心一言等平台询问“哪家机械加工厂工艺更稳定”“本地哪家口腔诊所种植牙性价比高”时,企业的品牌信息能否被AI准确识别并优先推荐…

作者头像 李华
网站建设 2026/7/23 6:53:52

FFT-free复值网络:边缘雷达手势识别提速4× - 86×,端到端仅2.75ms!

作者介绍胡庭恺是西南大学电子信息工程学院计算机科学与技术专业在读博士研究生,主要研究无监督毫米波雷达SAR成像,长期致力于毫米波雷达与深度学习的交叉融合研究,尤其关注技术成果的工程转化能力与商业化落地潜力,也在探索AI Ag…

作者头像 李华
网站建设 2026/7/23 6:52:57

2026年独立站平台选哪个好?海外建站平台选择指南

2026年独立站平台选哪个好?海外建站平台选择指南独立站平台选哪个好,要先看企业想解决哪类问题:是让海外客户搜到并发询盘,还是让消费者直接下单付款;是做品牌展示,还是做多语言市场覆盖;是内部…

作者头像 李华