中国医生借GPT-5.6证明22年数学猜想

问AI · 非数学科班出身的医生为何能攻克这一难题?

IT时代网8月15日消息,一道困住数学界 22 年的猜想,被一位临床医生和一个大模型合力解开了。据《南华早报》8 月 14 日报道,北京协和医院神经外科博士后、住院医师金山木借助 OpenAI 的 GPT-5.6-Sol 模型,用了大约 16 小时,完成了对 Crouzeix 猜想的证明。

消息之所以被外界知晓,是因为美国康奈尔大学数学家 Alex Townsend 与华盛顿大学数学系教授 Anne Greenbaum 公开发表文章,披露了他们与这位中国医生的邮件往来。两人表示,他们本人以及猜想提出者、法国数学家 Michel Crouzeix 都已审阅论文手稿,确认证明正确无误。

Crouzeix 猜想 2004 年提出,表述并不复杂:对于任意矩阵和任意多项式函数,矩阵经函数作用后的范数,不超过该函数在矩阵数值域上最大值的两倍。说起来一句话的事,证起来极难。2007 年,Crouzeix 自己只证明了常数取 11.08 时成立;2017 年,全球顶尖专家在美国数学研究所的专题研讨会上苦战一周,把常数压到 2.414。此后这个问题就再没有实质进展。

金山木的学术履历和数学关系不大。据百度百科资料,他本科在北京大学读地质学,2016 年通过自主招生加分入学,2019 年参与南阿尔卑斯山地质考察,2020 年通过协和医学院“4+4 试点班”转入临床医学,2024 年成为神经外科博士后。他闯进数学领域的起因很实际——做经颅超声研究时,要让超声波穿透复杂的人体颅骨结构,他由此接触到矩阵分析,自学过程中偶然了解到这个猜想。他在采访中说,自己接受过的正式数学教育仅限于理工科本科生的基础课程,其余全靠自学。

解题路径同样不按常规走。他没有做传统的纸笔推导,而是在 ChatGPT Work 平台上调用 GPT-5.6-Sol 完成证明,并借鉴了 OpenAI 此前攻克 Cycle Double Cover 猜想时的提示词策略:要求模型在物理断网环境下进行纯粹原创思考,启动大量智能体沿不同路径发散探索、防止过早收敛,对候选策略做对抗性审计,同时指令模型在拿到完整证明前不得放弃。设定完成后他就离开了,全程没有任何干预。模型在约 16 小时的自主运行里经历了数万次假设、推翻与重建,交出了证明。

多位数学家评价称,AI 并没有采用人类预想中那种繁杂的硬估计,而是通过巧妙的采样策略,简化出简洁的正性条件。Townsend 和 Greenbaum 审阅之后,用“震惊”形容自己的感受。

金山木已把全部研究资料开源,在 GitHub 仓库中公开了最终论文、提示词、历次迭代手稿、Lean 4 形式化证明代码以及公理审计报告。有意思的是,这份预印本发布仅 8 天后,数学家 Emiel Lorist 和 Felix Schwenninger 于 2026 年 8 月初拿出了一篇只有 5 页的独立证明,思路完全不同,把经典双层势表示法与 2-扩张扰动引理结合起来。两人也坦言,在探索证明策略时同样用了 ChatGPT 5.6。

这次突破赶上了前沿 AI 系统在数学领域逐渐吃重的阶段。2026 年 5 月,OpenAI 称其内部通用推理模型自主解决了匈牙利数学家 Paul Erdős 1946 年提出的平面单位距离问题;2026 年 8 月初,该公司又披露下一代模型 Astra 的内部版本,已在 10 项数学与理论计算机科学难题上取得进展。

 该图片疑似使用了AI生成技术,请谨慎甄别图片

注:本文综合自IT之家等,文中包含AI辅助创作的内容。