快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期六 · 09-05 02:37 约 2 分钟读完

Anthropic 用 Claude 在 11 天内完成费马大定理首个机器验证的 Lean 形式化证明

摘要

Anthropic 宣布,其 AI 模型 Claude 在 11 天内自主完成了费马大定理的 Lean 形式化证明,产出 1300 万行代码并验证 30,300 个定理,规模超现有 Mathlib 库 5 倍,标志着 AI 在数学推理与验证领域迈出关键一步。

Anthropic 今日发布了一项突破性成果:其 AI 模型 Claude 成功完成了费马大定理的 Lean 形式化证明。这是该著名数学难题首次获得完整、经机器验证的证明,整个过程由 Claude 在 11 天内大体自主完成,无需人工逐步干预。

这一成果的核心在于,Claude 生成了约 1300 万行 Lean 代码,并证明了 30,300 个相关定理,其中最终有 29,500 个被实际用于证明主线。值得注意的是,这一代码库规模是现有 Lean 数学库 Mathlib 的 5 倍以上,显示出 AI 在生成和处理大规模形式化数学内容上的潜力。

费马大定理自 1994 年由安德鲁·怀尔斯给出经典证明以来,一直是数学界公认的难点。将其转化为 Lean 语言的形式化证明,意味着每个逻辑步骤都必须经过机器的严格校验,这远比传统笔头证明更具挑战性。Claude 的自主完成,意味着 AI 已能跨越从理解问题到构建完整证明链的鸿沟。

从技术角度看,此次突破不仅验证了 Claude 在高级数学推理上的能力,也为 AI 辅助数学研究开辟了新路径。对于开发者而言,该成果展示了 AI 在处理超大规模、高精度逻辑任务时的可靠性,或将推动机器学习在定理证明、程序验证等领域的实际应用。

Anthropic 表示,这一进展是 AI 对齐与推理能力结合的一次重要演示。尽管距离 AI 完全自主进行原创性数学研究尚有距离,但此次成果无疑为行业树立了新的技术标杆,也为后续在更复杂数学问题上的 AI 应用提供了可复用的方法论。

AnthropicClaudeLean费马大定理
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词