Anthropic发布Claude 11天完成费马大定理机器验证证明
摘要
Anthropic宣布,其AI模型Claude在11天内基本自主完成了费马大定理的首个完整机器验证证明,生成1300万行Lean代码,并证明29500个中间定理。该成果标志着AI在数学推理领域取得重大突破,但验证工作仍待人工复核。
Anthropic于近日宣布,其人工智能模型Claude在11天内基本自主完成了费马大定理的首个完整机器验证证明。这一成果被视为AI在数学推理能力上的一个里程碑,但相关验证过程仍需人工复核。
费马大定理是一个困扰数学家三个多世纪的难题,由英国数学家安德鲁·怀尔斯在1995年首次给出经典证明。而此次Claude的成果并非提供新的数学思路,而是利用Lean证明助手,将定理的证明过程转化为机器可验证的代码,从而确保每一步逻辑的严谨性。
据Anthropic披露,Claude在此次任务中生成了约1300万行Lean代码,并证明了29500个中间定理。整个过程中,Claude在人类监督下基本自主运作,仅需少量人工干预,这在以往AI数学研究中极为罕见。
这项成果的意义在于,它展示了AI在长期复杂推理任务中的潜力,尤其是在需要严密逻辑和大量细节管理的领域。然而,Anthropic也强调,该证明尚未经过独立专家团队的全面审查,其可靠性和可复现性仍有待进一步确认。
业内分析认为,若该成果最终获得验证,将推动AI在数学研究、软件验证等依赖形式化证明的领域加速应用,但距离AI完全自主发现新数学定理仍有相当距离。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗