网易首页 > 网易号 > 正文 申请入驻

30年数学难题,AI仅6小时告破!陶哲轩:ChatGPT们都失败了

0
分享至


新智元报道

编辑:桃子

【新智元导读】昨晚,数学界炸了!AI数学家「亚里士多德」竟在6个小时内,一键破解了30年难题的简版,引陶哲轩盛赞。数学领域Vibe proving时代来了。

30年未解数学难题,终于告破!

由HarmonicMath开发的AI数学家「亚里士多德」(Aristotle),100%独立完成了埃尔德什问题。


它在Lean证明系统中,耗时仅6个小时,验证只需1分钟。

全程没有一丝人类的参与辅助,这一刻,堪称数学界的「登月」时刻。


HarmonicMath创始人Vlad Tenev感慨道,「数学圈正迎来巨变,vibe证明的时代,来了」!


就连菲尔兹奖得主陶哲轩,高度赞扬了AI数学家「亚里士多德」。


AI发现数学的时代,正式开始了。

30年难题告破,AI做到了

一直以来,数学家Erdős Pál的「问题列表」,就像一座知识的珠穆朗玛峰,考验着人类的极限。

那些悬而未决的难题,悬赏金大多从几十美元到上万美元不等。

其象征意义远大于实际价值,成为了无数数学家的精神勋章。


30年来,第124号问题(Erdős )在论文「Complete sequences of sets of integer powers」中提出后,至今无人破解。

E124核心是:给定k个自然数d_i ≥ 2,如果∑ 1/(d_i - 1) ≥ 1,那么对于自然数n,总存在a_i,使得n = ∑ a_i。

且每个a_i,在d_i下的「数字」仅限于{0,1}。


直白讲,它本质上在问——极端约束下,是否总能用「二进制」表示任意大数,而不受基数干扰?

这牵扯到了「组合数学」的深水区,传统方法卡在了gcd条件和边界案例上。

直到昨晚,这堵墙崩塌了。

Harmonic团队量身打造了「数学超级智能」原型——亚里士多德(Aristotle),结合了强化学习、蒙特卡洛树搜索,以及Lean形式化语言。


输入问题后,它通过搜索上亿种证明策略,最终输出了100%可验证的定理。

数学家Boris Alexeev表示,这是AI输出的三个定理中,自己最喜欢的一个:

theorem erdos_124 : ∀ k, ∀ d : Fin k → ℕ, (∀ i, 2 ≤ d i) → 1 ≤ ∑ i : Fin k, (1 : ℚ) / (d i - 1) → ∀ n, ∃ a : Fin k → ℕ, ∀ i, ((d i).digits (a i)).toFinset ⊆ {0, 1} ∧ n = ∑ i, a i


地址:https://github.com/plby/lean-proofs/blob/main/ErdosProblems/Erdos124.md

顺便提一句,E124问题一共有两个不同版本,全部由埃尔德什提出。

目前,AI亚里士多德解决的是一个比较简单的版本。


在时间方面,Aristotle花了6小时,而Lean只花了1分钟。

Erdős问题的网站维护者表示,Aristotle的表现最令人深刻!


ChatGPT、Gemini都失败了

陶哲轩对此点评道,就我所知,Gemini和ChatGPT的深度研究工具,都没有找到关于这个问题的任何新的、有价值的文献。

Gemini给出了一个简单的观察:如果把数字1排除掉,那么gcd条件就会变成必要的;它还解释了条件


的重要性,并把它和一些关于Cantor集的平行研究联系了起来,尤其是「Newhouse gap lemma」。

不过,它没有找到与这个问题直接相关的新文献。

ChatGPT则大量依赖本网页作为主要权威来源,例如引用Aristotle的证明、本页引用的其他论文,以及相关问题的页面。

因此,并没有获得新的信息,不过读者可能会觉得这些AI生成的总结还是挺有意思的。


陶哲轩:数学低垂果实,正被AI收割

在mathstodon上,陶哲轩还分享了多年来自己的经验——

他表示,当前真实情况是:数学未解问题服从「长尾分布」,AI自动化「收割」恰恰集中在长尾最末端。


有大量问题其实相对容易证明或证伪,但因为真正能投入研究的专家数学家数量有限,这些问题几乎没得到过多少关注。

换句话说,这条「尾巴」里其实藏着不少触手可及的「低垂果实」:

如果有办法把这些问题进行大规模的自动化攻克,就可能产出相当多新的数学结果。

去年,陶哲轩在Equational Theories Project里亲历过一个类似的情况。

在这个项目中,他们面对的是普遍代数里2200万条可能的蕴涵关系(implication),如果全靠人类去做,必定花费非常多的时间。

于是,他们决定从一开始用比较「低技术含量」的自动化方法,短短几天就解决了大部分。


接下来,又不断上复杂手段,啃那些前几轮怎么都啃不动的顽固难点。

最后,剩下几条特别顽固的,又花费了人类数学家几个月的时间搞定。

目前,Erdős问题网站收录了1108个,曾在Erdős至少一篇论文中出现过的问题。

其中,既有像E3这种臭名昭著的难题,也有数量众多、更不起眼、几乎没人关注过的问题,甚至连Erdős本人都没再回头研究过。

最近几周,这个网站的「未解」标签突然少了近十个,全部在AI加持下文献搜索发现——

实际上,这些问题早就被他人解决。

正在研究这些问题的人类数学家也结合使用了AI工具和形式化证明助手:

有的在Lean里验证已有证明,有的生成和这些问题相关的整数序列项,还有的补上某个既有思路里缺失的证明步骤。

最近,又发现了另一类落入自动化工具能力范围的「低垂果实」——那些因为描述上存在技术性瑕疵而意外变得好解决的问题。

E124就是一个典型,这个问题完整版本有些难度,曾在Erdős的三篇论文中出现。

但其中有两篇遗漏了一个关键假设,使得这一版本其实只是Brown判据的直接推论。

这事一直没有人发现,直到Boris Alexeev把问题丢给自动化工具Aristotle,没想到AI在几小时内自主找到了漏洞,并用Lean完成了形式化证明。

可以看到,AI正在点亮数学的「暗森林」。

正如陶哲轩所言,「自动化工具先清理掉最容易的问题,把真正难啃的那部分剥离出来,让人类数学家把精力花费在值得的地方」。

参考资料:

https://www.erdosproblems.com/forum/thread/124-1892

https://x.com/SebastienBubeck/status/1994946303546331508?s=20

https://mathstodon.xyz/@tao/115639983683442577

https://x.com/thomasfbloom/status/1995094668879462466?s=20

秒追ASI

⭐点赞、转发、在看一键三连⭐

点亮星标,锁定新智元极速推送!

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
韩国顶尖大学医学生作弊,用PS修X光?!牙齿根管做坏了直接P成好的,网友炸了...

韩国顶尖大学医学生作弊,用PS修X光?!牙齿根管做坏了直接P成好的,网友炸了...

英国那些事儿
2026-01-14 23:25:58
“花式”揽储:有银行送鸡蛋吸引他行储户,多家中小银行上调存款利率……

“花式”揽储:有银行送鸡蛋吸引他行储户,多家中小银行上调存款利率……

中国基金报
2026-01-16 00:18:40
5行代码,逼疯整个硅谷!澳洲放羊大叔,捅开AI编程奇点

5行代码,逼疯整个硅谷!澳洲放羊大叔,捅开AI编程奇点

新智元
2026-01-14 17:38:10
41岁男子河边钓鱼喊技师服务,全程一丝不苟,网友:一个字,雅!

41岁男子河边钓鱼喊技师服务,全程一丝不苟,网友:一个字,雅!

农村情感故事
2026-01-15 18:52:11
风腐同查同治,提高反腐败穿透力

风腐同查同治,提高反腐败穿透力

中国青年报
2026-01-16 01:22:35
“手写代码已不再必要!”Redis之父罕见表态:AI将永远改变编程,网友质疑:我怎么没遇到这么好用的AI!

“手写代码已不再必要!”Redis之父罕见表态:AI将永远改变编程,网友质疑:我怎么没遇到这么好用的AI!

CSDN
2026-01-15 18:56:03
哭着鞠躬道歉!湖南灿灿子杀猪宴紧急叫停,抄作业被全网骂停了

哭着鞠躬道歉!湖南灿灿子杀猪宴紧急叫停,抄作业被全网骂停了

千言娱乐记
2026-01-15 19:41:53
终于适配!iOS 微信更新 8.0.68 版本

终于适配!iOS 微信更新 8.0.68 版本

花果科技
2026-01-15 15:44:50
给屈死的女孩一个公道,邵东老刑警们眼中的1978年岩洞少女尸骨案

给屈死的女孩一个公道,邵东老刑警们眼中的1978年岩洞少女尸骨案

顾氏造船厂厂长
2026-01-15 08:00:12
人去楼空,杉杉集团上海总部大楼流拍后降价4.5亿

人去楼空,杉杉集团上海总部大楼流拍后降价4.5亿

财视传播
2026-01-14 10:40:22
贵州跑圈“女神”李绍艳去世,年仅30岁,多次在马路上逆行摆拍

贵州跑圈“女神”李绍艳去世,年仅30岁,多次在马路上逆行摆拍

裕丰娱间说
2026-01-15 12:51:13
央行副行长邹澜:近期中国物价水平已出现积极变化

央行副行长邹澜:近期中国物价水平已出现积极变化

新京报
2026-01-15 17:15:06
海南封关运作后,就相当于中国版的新加坡正式上线了。

海南封关运作后,就相当于中国版的新加坡正式上线了。

流苏晚晴
2025-12-21 16:05:12
偶遇吴彦祖父女,12岁吴斐然高又瘦,混血长相在普通人里算好看的

偶遇吴彦祖父女,12岁吴斐然高又瘦,混血长相在普通人里算好看的

琴声飞扬
2026-01-14 11:09:51
婆婆让我吃剩菜,她女儿回家做八道菜,我点一桌海鲜一人吃

婆婆让我吃剩菜,她女儿回家做八道菜,我点一桌海鲜一人吃

真实人物采访
2026-01-15 18:00:03
落草凤凰不如鸡?40岁女神“下海”拍短剧,老公于三年前被判无期

落草凤凰不如鸡?40岁女神“下海”拍短剧,老公于三年前被判无期

鹿楠
2025-12-31 21:25:03
深渊凝视:为什么从月球看地球,会让人感到一种彻骨的恐惧?

深渊凝视:为什么从月球看地球,会让人感到一种彻骨的恐惧?

观察宇宙
2026-01-14 17:34:31
深夜利空,航天龙头利润暴降4487%,20个龙头业绩暴雷了,别踩雷

深夜利空,航天龙头利润暴降4487%,20个龙头业绩暴雷了,别踩雷

风风顺
2026-01-16 04:05:03
给钱就卖!曼联冬窗清洗26岁水货 加盟4年0球0助攻

给钱就卖!曼联冬窗清洗26岁水货 加盟4年0球0助攻

球事百科吖
2026-01-16 04:50:59
欧洲拟出兵,特朗普再拒绝就搞美国?美末日飞机升空,2国已危险

欧洲拟出兵,特朗普再拒绝就搞美国?美末日飞机升空,2国已危险

田柳
2026-01-16 09:00:03
2026-01-16 10:03:00
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
14342文章数 66501关注度
往期回顾 全部

科技要闻

被网友"催"着走,小米紧急"抄"了特斯拉

头条要闻

马克龙警告美国:侵犯格陵兰岛将引发"前所未有后果"

头条要闻

马克龙警告美国:侵犯格陵兰岛将引发"前所未有后果"

体育要闻

聂卫平:黑白棋盘上的凡人棋圣

娱乐要闻

92岁陶玉玲去世,冯远征曹可凡悼念

财经要闻

深圳有白银商家爆雷 维权群超350人

汽车要闻

吉利帝豪/缤越推冠军一口价 起售价4.88万

态度原创

本地
游戏
数码
公开课
军事航空

本地新闻

云游内蒙|黄沙与碧波撞色,乌海天生会“混搭”

《波斯王子:时之砂》重制版网页更新显示今日发售

数码要闻

Keychron海外推出K3 Max全木版机械键盘=,119.99美元

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

美国已正式开始出售委内瑞拉石油

无障碍浏览 进入关怀版