内容提要
菲尔兹奖得主陶哲轩牵头人类数学协会(AHM)发表声明,抵制OpenAI。OpenAI无视咨询小组红线,用内部模型测试约8000道开放数学题,发布700多份机器生成证明,命中率约5%,每道仅耗3小时算力。数学家批评这些证明逻辑混乱、未经同行评审,且缺失密码学领域。陶哲轩警告“证明消化不良”与不可逆污染,杨立昆则持相反观点,认为数学正迎新时代。
延伸解读
咨询小组红线被无视
OpenAI曾与普林斯顿高等研究院设立数学与人工智能咨询小组,其首份报告明确警告前沿AI公司不应在内部模型上擅自测试高深数学难题。然而OpenAI无视这一红线,用内部模型测试了约8000道开放数学题,并发布700多份机器生成证明。这直接导致数学家批评其无视科研规范,成为抵制声明的导火索。
机器证明的质量危机
这些机器生成的证明被数学家批评为逻辑混乱、未经同行评审。例如,Dana Moshkovitz发现其毕生研究的唯一博弈猜想被宣称证明,但文档充斥着混乱的逻辑跳跃和诡异构造,她形容为“致幻剂写出的东西”。陶哲轩警告这种“证明消化不良”和不可逆污染,即使只是知道答案存在,也会污染其他研究路径。
密码学领域的缺失
在这批发布的成果库中,唯独缺失密码学领域。有消息指出,AI公司可能已在暗中利用强大算力探测现代密码学协议和原语的底层漏洞。这一缺失引发数学家更深层的担忧:AI公司或许在秘密进行敏感领域的研究,而非公开推动数学发展。
杨立昆的反驳视角
图灵奖得主杨立昆对此次冲突持相反观点,认为数学正迎来新时代。他表示形式证明将大幅自动化,重点将转向发展新概念、新抽象、新定义和新猜想,并以“船的发明降低了游泳的重要性,却让我们发现新大陆”作比喻。这与陶哲轩等数学家的抵制立场形成鲜明对比。
Q&A
陶哲轩牵头的人类数学协会(AHM)为什么要联合抵制OpenAI?
因为OpenAI无视数学与人工智能咨询小组(AGMAI)的红线警告,用内部模型测试了约8000道开放数学题,并发布700多份机器生成的证明,这些证明逻辑混乱、未经同行评审,且缺失密码学领域。数学家们认为这是对学术规范的破坏和算力霸权炫耀。
OpenAI这次发布的机器证明具体是怎么产生的?
OpenAI动用内部模型测试了大约8000个开放性数学问题,命中率约5%,平均解决一道高难度难题只消耗3个小时的GPT-Pro级别算力,最终生成了700多份证明文件。
数学家们对OpenAI发布的证明质量有什么批评?
数学家批评这些证明逻辑混乱、充斥大量先验结论却无适用性说明,采用人类从未见过的诡异构造,没有AI辅助根本读不懂,且未经同行评审,缺乏对前人工作的尊重与解释。
陶哲轩所说的“证明消化不良”和“不可逆污染”是什么意思?
“证明消化不良”指大量机器生成的证明无法被人类有效理解和消化;“不可逆污染”指一个问题一旦被宣称解决,就再也回不到未解决状态,即使只是知道答案存在,也会污染其他可能带来更深刻洞见的研究路径。
杨立昆对AI与数学的关系持什么观点?
杨立昆认为数学正迎来新时代,形式证明将大幅自动化,重点将转向发展新概念、新抽象、新定义和新猜想。他用船的发明降低游泳重要性却让人发现新大陆来比喻这一转变。
这次事件中为什么密码学领域的缺失令人不安?
在这批发布的成果库中唯独缺失密码学领域,有消息指出AI公司实际上已在暗中利用强大模型算力悄悄探测现代密码学协议和原语的底层漏洞,这引发了安全担忧。