OpenAI这是拿千禧年难题当Benchmark刷啊。。。

OpenAI这是拿千禧年难题当Benchmark刷啊。。。

💡 原文中文,约3700字,阅读约需9分钟。
📝

内容提要

《纽约时报》披露OpenAI与数学家Buckmaster的冲突细节。OpenAI称用户数据未影响模型,并否认威胁。争议焦点是OpenAI不愿让Anthropic员工Alpöge在论文中署名。随后OpenAI宣布继纳维-斯托克斯方程后再攻千禧年难题,传闻指向霍奇猜想,被质疑用上万Agent刷题。

🔎

延伸解读

数据争议的独立核查困境

OpenAI更新了用户数据说法,称Buckmaster的Codex提示词和7月3日后的用户输入均未影响内部模型。这比此前“无法完全排除匿名用户数据”的表态更明确,但仍是单方面声明,没有公开技术材料可供独立核查。读者需注意,这类争议的核心往往不是技术本身,而是缺乏第三方验证机制,导致信任只能依赖公司自述。

署名冲突背后的竞争逻辑

争议焦点之一是OpenAI不愿让Anthropic员工Alpöge在论文中署名。Bubeck明确表示,不能让Anthropic员工参与OpenAI内部项目。Buckmaster则认为研究同时使用了Claude和Codex,应共同处理。这反映出AI公司竞争已渗透到学术合作中,署名不再只是荣誉分配,而成为公司间博弈的工具,可能影响研究透明度和合作意愿。

暴力解题系统的资源规模

OpenAI披露,纳维-斯托克斯一题动用了约1万个并行Agent,产生270万条消息,消耗约1300亿输出Token,从启动到找到解法仅88小时。整轮测试共490万条Agent消息和约3000亿输出Token。这种规模显示,AI数学突破越来越依赖海量算力和Agent并行,而非单点算法创新,可能改变数学研究的成本结构和参与门槛。

霍奇猜想传闻与验证风险

OpenAI宣布在另一道千禧年难题上取得“实质性进展”,传闻指向霍奇猜想。但该猜测源自旧线索,尚未证实。霍奇猜想连接拓扑学与代数几何,是核心难题。读者应区分“实质性进展”与“完整证明”,尤其纳维-斯托克斯论文仍在审查中。若缺乏形式化验证和同行评议,传闻可能被过度解读,需关注后续正式发布。

Q&A

OpenAI和数学家Buckmaster的冲突起因是什么?

冲突起因是OpenAI不希望Buckmaster的合作者Alpöge(Anthropic员工)在纳维-斯托克斯证明论文中署名。Buckmaster拒绝OpenAI提出的合作方案,随后OpenAI研究负责人Bubeck被指威胁Buckmaster,称其可能毁掉自己的职业生涯。

OpenAI关于用户数据影响模型的最新说法是什么?

OpenAI更新说法称,Buckmaster过去两个月的Codex提示词绝不可能以任何方式影响内部模型,7月3日之后的任何用户输入也不可能进入这套系统。这比此前“无法完全排除匿名用户数据曾帮助改进模型”的表态更明确。

OpenAI在纳维-斯托克斯方程证明中使用了多少计算资源?

OpenAI动用了约1万个并行Agent,产生270万条消息,消耗约1300亿个输出Token。从Agent启动到找到解法只用了88小时,随后GPT-6 Astra又花费17小时完成Lean形式化和验证。

霍奇猜想是什么?

霍奇猜想是数学中连接拓扑学和代数几何的猜想,认为在一类复杂几何空间中,由拓扑学发现的特殊“洞”背后都能找到由代数方程构成的几何结构。它由英国数学家William Hodge在20世纪提出,是七大千禧年大奖难题之一。

OpenAI下一个要攻克的千禧年难题是什么?

OpenAI宣布在另一道千禧年大奖难题上取得“实质性进展”,最新传闻指向霍奇猜想。此前已有数学教授从可信渠道听说被攻克的是霍奇猜想,如今OpenAI的确认让这一传闻再次受到关注。

Buckmaster认为纳维-斯托克斯证明的主要智力功劳应该归谁?

Buckmaster认为主要智力功劳应该归于西班牙数学家Diego Córdoba和Luis Martínez-Zoroa,他们几年前提出了通过一连串精确外力“踢击”将流体推向极端状态的新策略。Buckmaster负责设置问题,Alpöge将问题输入模型,两人根据输出反馈修正。

🏷️

标签

➡️

继续阅读