Claude 11天证明费马大定理,完成数学史上最大Lean证明
近日,Anthropic 宣布了一项数学界与AI领域的重磅突破:在清华姚班顶尖人才彭天一的带领下,其大模型 Claude 仅用 11 天便完成了费马大定理的首个端到端机器验证证明。这标志着 AI 完成了数学史上规模最大的证明工作。
350年世纪难题的机器验证
费马大定理曾困扰人类数学界超过 350 年。直到 1995 年,英国数学家安德鲁·怀尔斯才利用现代数学工具写出一份 129 页的证明论文。然而,现代数学证明极其复杂,人工验证往往需要顶尖专家耗费数月甚至数年。
为了解决验证难题,数学界引入了“形式化”概念,即将人类编写的数学证明翻译成计算机可运行的编程语言(如 Lean),让机器逐步推导验证。此前,学界普遍认为形式化费马大定理是一个需要耗时数年的超级工程,帝国理工学院教授 Kevin Buzzard 主导的项目仅第一阶段蓝图就长达 86 页。
1300万行代码与60亿Token
面对这一超级工程,Claude 展现了 AI 的暴力美学与精准的系统设计。整个工作仅耗时 11 天,且几乎完全由 AI 自主完成。
在此期间,Claude 疯狂编写了 1300 万行代码,生成了 30300 个可验证定理,其中 29500 个被最终采纳并纳入证明。这一体量是全球最大数学定理库 Mathlib 的 5 倍以上,整个过程消耗了高达 60 亿个 Token,成为迄今为止规模最大的 Lean 证明。
数十个Agent自主协作
由于形式化证明必须从最基本的公理出发层层构建,Claude 在证明费马大定理的过程中,顺带证明了 29000 多个所需的中间数学定理,涵盖代数、几何、数论、调和分析等多个此前未被形式化的分支。
在整个过程中,人类研究者几乎未进行深度干预,仅提供了诸如“高优先级处理概形的雅可比簇”等高层指令。剩下的工作由数十个 Claude Agent 疯狂交互完成,它们自主定义概念、证明中间定理并层层构建证明逻辑。
最终,Lean 编译器仅依靠三个最基本的标准公理通过了所有检查。当程序运行结束,控制台弹出神圣的“PROVED”字样时,Claude 的内部日志也记录下这一历史时刻:“费马大定理的根节点被读取为 PROVED……这是本次行动的目标……一个历史性的时刻。”
原始来源: 新智元 ↗
本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。