OpenAI与数学界的紧张关系再度升级。

菲尔兹奖得主陶哲轩近日在个人博客转载了一份由人类数学协会(AHM)发布的声明,批评OpenAI无视数学界研究规范,并呼吁数学家停止与其合作。

争议源于OpenAI公开的一批数学研究手稿,其内部模型尝试解决约4000道数学问题,最终整理出涉及372组成果的研究材料,并公开了部分Lean形式化证明代码。

但成果规模并未换来学界一致认可。数学家关心的不只是证明是否正确,还包括推导能否被理解、是否充分引用前人工作,以及新方法能否经过同行讨论融入现有知识体系。

形式化验证可以检查逻辑推导,却不能自动替代对命题含义、研究贡献和学术背景的人工审查。“一次性发布700多份文件,展示的不是学术研究,而是权力。”声明称。

长期深耕唯一博弈猜想的理论计算机科学家达娜·莫什科维茨(Dana Moshkovitz)第一时间研读OpenAI公布的相关论文,称论文充斥着难以理解的构造、语焉不详的推理步骤、让人摸不着头脑的文献引用。得克萨斯大学奥斯汀分校理论计算机科学家斯科特·阿伦森(Scott Aaronson)将OpenAI发布日形容为“数学末日”。

也有网友认为陶哲轩的观点过于极端,不应阻止可能造福所有人的技术发展。西北大学数学家布赖娜·克拉(Bryna Kra)认为,AI有望帮助研究者探索过去难以解决的问题,但企业应以更符合学术规范的方式发表成果,让同行能够检查、理解和继续研究。

菲尔兹奖得主陶哲轩点名批评OpenAI,呼吁数学家停止合作(1)

双方矛盾的核心,是AI生成成果的速度与人类理解能力之间出现落差。传统数学研究需要通过论文、研讨会和同行交流逐步解释证明、完善方法;当商业实验室一次性发布数百份复杂手稿,后续核验、修订和知识整合的成本却可能转移给学术共同体。研究议程、成果发布节奏和模型资源也因此越来越受到少数科技公司的影响。

这场争议并非突然出现。陶哲轩此前已与另外24位菲尔兹奖得主联署声明,警告AI公司将数学难题当作模型能力基准,可能使技术竞争偏离数学研究追求理解与洞见的初衷。

9月29日,数学与人工智能咨询组(AGMAI)发布建议,明确反对前沿AI实验室使用外界无法访问的内部模型测试高难度数学问题。

OpenAI称,此次发布参考了AGMAI的建议;AHM则认为,公司忽视了建议的核心前提,因此呼吁数学家停止与OpenAI合作。此外,AGMAI还要求实验室不得将数学成果发布用作推广模型的营销工具,相关发布应披露模型名称、提示词、算力成本与失败记录等信息。

随着AI不断提升科研产出能力,数学界面临的已不只是机器能否证明定理的问题,更是由谁决定研究方向、谁承担验证成本,以及如何确保技术进步仍服务于知识积累。