这几天全球数学圈的朋友圈基本被同一件事刷屏。
8月13日港媒SCMP大篇幅登了一则来自北京的科技消息,8月15日多家海外AI资讯站跟进推送,到了8月17日连维基百科的Crouzeix条目底下都新增了一段"ClAImed proof",把这件事写进了历史底稿。
震源是一份挂在Preprints.org上的14页论文,作者身份栏写着——北京协和医院神经外科住院医师。一个每天穿着白大褂在病房里查房的年轻医生,把一道折磨了国际顶尖数学家整整22年的世界级难题给做出来了。
![]()
而且他不是数学系博士出身,本科念的是地质,后来读到医学博士,数学水平就是理工科通用的那点底子,剩下全靠自学。这剧本要不是有Crouzeix本人亲自逐行核验拍板确认,估计没人敢信。
主角叫金山木,一名协和医院博士后兼神经外科住院医师。他的日常是手术台和值班室,不是黑板和讲台。
这道题他是被"顺"进去的——做经颅超声课题时研究颅骨对声波的复杂散射,一头扎进了矩阵分析,然后在文献里撞见了那个几何形态漂亮得像艺术品的Crouzeix猜想。倒回8月4日,事情还有另一条支线。
![]()
荷兰代尔夫特理工的Lorist和特文特大学的Schwenninger两位教授,在arXiv甩出编号2608.03841的独立证明,只用了5页纸,走的是双层势加2-扩张扰动引理这条更传统的路。
他们在文章里坦率承认,探索过程中也调用了ChatGPT做辅助。也就是说,同一道封存22年的题,在8天之内被两组风马牛不相及的作者用两种完全不同的路径同时敲开。
这不是巧合能解释的量级。我的判断是,这标志着AI在纯理论数学里的角色已经从"跑腿工具"跃迁到"能贡献决定性思路的合作者",界线一夜之间被抹平。
![]()
时间往回拨到7月27日。金山木把v1版预印本悄悄挂上服务器时没有任何张扬。
7月30日康奈尔大学的Alex Townsend教授照旧刷学术站,本来想找GPT-5.6又编了什么伪证的笑话看,点开这篇的前两小时抱着挑刺心态,读到后半段脸色就变了。
他随即拉上华盛顿大学的Anne Greenbaum合作复核,两人得出的结论出奇一致:这份论证是硬的。再看猜想本身有多硬。
![]()
法国数学家Michel Crouzeix在2004年提出一个看上去无害的不等式:任意多项式作用在任意方阵上,其算子范数不会超过该多项式在这个矩阵数值域上最大模的2倍。式子简短到写不满一行,可要证那个"2"是最优常数,整整22年没人跨得过去。
历史上的里程碑清清楚楚。2004年提出,2007年Crouzeix本人只能给出常数11.08,跟目标差着数量级。
2017年他和西班牙数学家Palencia联手把上界压到1+√2≈2.414,看着离2就一根头发的距离,可这根头发九年没人拔得下来。
![]()
同年美国数学研究所在圣何塞开了整整一周的闭门研讨,Embree、Overton、Greenbaum这批一线大腕轮番上阵,散会时的普遍共识是短期没戏。金医生的破题方式在传统学者眼里几乎是"歪门邪道"。
他没有堆草稿纸熬夜推公式,而是把OpenAI早前攻克Cycle Double Cover猜想那份神级提示词拆开研究,改造成适配Crouzeix问题的版本,然后按下运行键就去查房了。这个操作放在应用数学系里,属于跨物种的思维方式。
那份提示词里的门道全在细节。切断外网访问、禁止子智能体过早收敛、必须开出多条互相独立的证明路径、每条路径都要通过对抗性审查、找不到反例才准保留、凑不齐完整证明不许停机。
![]()
金山木设完这一整套规则就转身回科室去了,全程零干预。GPT-5.6 Sol在ChatGPT Work模式下自主跑了大约16个小时。
产出的那个决定性引理让Townsend这批老手当场懵了——AI压根没走人类预设的硬拼估计那条路,而是用一种极其精巧的采样构造,把整个难题化归到一个简洁得不可思议的正性条件。这套打法数学界这22年根本没往那儿想。
更让人心服的是金医生的姿态。他把GitHub仓库摊得干干净净:完整提示词、历次迭代手稿、Lean 4形式化验证代码、公理审计报告,一样不落。
![]()
这份透明度在正统学术圈里都算稀有品,让每一个想找茬的同行都可以直接复现整个过程。Crouzeix老爷子本人也没端架子。
这位22年前亲手出题的法国数学家,逐行审阅了金医生的手稿,然后在私下通信里给出了明确背书。原本以为这件事情会有一场旷日持久的圈内争议,结果Crouzeix、Townsend、Greenbaum三方直接一次性拍板。
站在时政评论的角度,这件事的分量远超一个具体猜想的了结。第一层意义是产业信号——全球最顶尖的推理模型集中在美国头部公司手里没错,但用这套工具做出重量级原创成果的人,可以在北京协和的值班室里冒出来。
![]()
人才地图正在被AI这台推土机重新画。第二层意义是范式冲击。
当一个业余时间自学数学的临床医生能摘下应用数学皇冠上的一颗明珠,"数学家"这个身份的护城河已经被填平了一大截。未来五年,跨界原创将不再是新闻,"专业出身"这四个字的溢价会加速缩水。
这是身份的重构。第三层是我更在意的战略含义。
![]()
中美两国在前沿AI的军备竞赛里,模型能力只是显性指标,"谁能用它做出别人做不出的东西"才是隐性护城河。金山木这类案例证明,一个体制内的临床科研工作者只要方法得当,完全可以借助美国厂商的模型产出世界级成果——工具流通性远比想象中强。
反过来看,这也给国内AI产业提了个醒。我们的大模型如果只满足于跑通日常客服、写写PPT,就永远只能在"应用"层打转。
真正的分水岭在于能不能支撑起金山木那种十六小时无监督自主推理的场景,这才是需要死磕的方向。这10天里国内几家头部厂商也在跟进相关能力,节奏不能松。
![]()
至于台湾地区那边这几天的科技媒体反应,倒是挺耐人寻味。他们的相关平台在转载SCMP报道时,重点全落在"AI替代人类专家"的焦虑上,几乎没有报道协和这个身份要素。
这种选择性叙事说明什么,明眼人一看便知。再把时间拉回眼下。
8月17日维基百科英文版把这条冷冰冰地写进了词条历史,8月18日的今天,仍然有欧洲学者在社交媒体上感叹这是"数学史上第一次由无正规训练的圈外人借助AI攻克长期猜想"。这句话背后,是一整代科研工作者身份坐标的漂移。
![]()
一个协和的神经外科住院医,用一段精心设计的提示词加十六个小时的算力,替全球数学界拆掉了那颗压在心口22年的定时炸弹。数学圈这次不是简单地炸了,是被逼着重新审视自己接下来的活法。
属于AI辅助原创科研的黄金年代,就从2026年这个夏天,在北京东单的一间值班室里,被这位年轻医生按下了启动键。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.