陶哲轩质疑OpenAI数学证明发布:719份手稿中仅10份附推理链
摘要
OpenAI于10月发布719份AI生成数学解答,涵盖372个数学结果族。数学家陶哲轩对此提出质疑,指出发布未完全达到AGMAI顾问小组标准:仅10份附推理链,约42%未经形式化处理,人类可理解性存疑。
OpenAI在10月公开了一批AI生成的数学研究成果,总计719份手稿,覆盖372个数学结果族,并涉及数百项开放研究问题。这批内容最初于10月6日在GitHub上线时数量为722份,次日因一处符号错误及其连锁影响撤回3份,最终目录定格在719份。
值得注意的是,OpenAI在发布前曾咨询由普林斯顿高等研究院主持的“数学与人工智能顾问小组”(AGMAI),并参考了该小组的公开建议。但根据公开信息,此次发布并未完全满足AGMAI提出的标准。该小组此前明确建议,前沿AI实验室应停止在专有、外界无法访问的模型上测试高难度数学问题,同时要求披露模型名称、提示词、推理链、耗时及计算成本等关键信息。而OpenAI此次仍使用了专有模型,且719份手稿中仅10份附有模型推理链。
在人类可理解性方面,AGMAI强调AI生成的证明应当便于数学家审查和学习。然而据报道,OpenAI发布的证明中约42%未经形式化处理,也未提供将自然语言证明与形式化产物关联的机器可读元数据。这意味着相当一部分内容难以被数学界直接验证或追溯。
AGMAI同时声明,其咨询角色不构成对OpenAI获取或发布这些结果的认可,最终仍需由数学界评估相关建议是否得到充分执行。数学家陶哲轩随后对此事提出质疑,核心问题指向:这批AI数学证明,人类真的理解了吗?该事件再度引发关于AI数学研究透明度与可审查性的讨论。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗