Anthropic 用 Claude 在 11 天内完成费马大定理首个机器验证的 Lean 形式化证明
Anthropic 宣布,其 AI 模型 Claude 在 11 天内自主完成了费马大定理的 Lean 形式化证明,产出 1300 万行代码并验证 30,300 个定理,规模超现有 Mathlib 库 5 倍,标志着 AI 在数学推理与验证领域迈出关键一步。
Anthropic 今日发布了一项突破性成果:其 AI 模型 Claude 成功完成了费马大定理的 Lean 形式化证明。这是该著名数学难题首次获得完整、经机器验证的证明,整个过程由 Claude 在 11 天内大体自主完成,无需人工逐步干预。
这一成果的核心在于,Claude 生成了约 1300 万行 Lean 代码,并证明了 30,300 个相关定理,其中最终有 29,500 个被实际用于证明主线。值得注意的是,这一代码库规模是现有 Lean 数学库 Mathlib 的 5 倍以上,显示出 AI 在生成和处理大规模形式化数学内容上的潜力。
费马大定理自 1994 年由安德鲁·怀尔斯给出经典证明以来,一直是数学界公认的难点。将其转化为 Lean 语言的形式化证明,意味着每个逻辑步骤都必须经过机器的严格校验,这远比传统笔头证明更具挑战性。Claude 的自主完成,意味着 AI 已能跨越从理解问题到构建完整证明链的鸿沟。
从技术角度看,此次突破不仅验证了 Claude 在高级数学推理上的能力,也为 AI 辅助数学研究开辟了新路径。对于开发者而言,该成果展示了 AI 在处理超大规模、高精度逻辑任务时的可靠性,或将推动机器学习在定理证明、程序验证等领域的实际应用。
Anthropic 表示,这一进展是 AI 对齐与推理能力结合的一次重要演示。尽管距离 AI 完全自主进行原创性数学研究尚有距离,但此次成果无疑为行业树立了新的技术标杆,也为后续在更复杂数学问题上的 AI 应用提供了可复用的方法论。