百年黎曼猜想被Claude破了新纪录!是个未公开新模型

百年黎曼猜想被Claude破了新纪录!是个未公开新模型

💡 原文中文,约2900字,阅读约需7分钟。
📝

内容提要

Anthropic的Claude研究模型在黎曼猜想上取得重大进展,将满足猜想的零点比例下界从41.6%提升至67.2%。该模型通过60个智能体、3100万输出Token,自主生成思路、交叉审稿并验证结果,人类仅提供鼓励。虽未完全证明猜想,但刷新了长期纪录,展示了AI在开放数学问题上的研究能力。

🔎

延伸解读

突破的数学含义

Claude将满足黎曼猜想的零点比例下界从41.6%提升至67.2%,但这并不等于证明了黎曼猜想,也不意味着剩余32.8%的零点不满足猜想。它只是证明了至少67.2%的非平凡零点位于临界线上,距离证明所有零点都在线上仍有本质差距。这一进展刷新了长期停滞的纪录,但距离最终解决猜想仍有很长的路。

AI研究方式的变革

Claude通过60个智能体、3100万输出Token,自主生成思路、交叉审稿、验证结果,甚至独立复现证明,人类仅提供鼓励。这展示了AI在开放数学问题上的研究能力,不再局限于有标准答案的题目。但需注意,这并不等于AI已具备完全自主的科研能力,其过程仍依赖人类设定目标和提供资源。

结果的可信度与局限

Anthropic内部数学家及外部专家已审阅论文,并提供了Lean形式化验证,但尚未完成传统同行评审。Anthropic也明确表示,该方法大概率无法直接通向完整证明。因此,这一结果虽令人振奋,但需谨慎对待,其长期影响和可推广性仍有待进一步验证。

Q&A

Claude在黎曼猜想上取得了什么具体进展?

Claude将满足黎曼猜想的黎曼ζ函数零点比例的下界从41.6%提高到了67.2%,即证明了至少67.2%的非平凡零点位于临界线上。

Claude是如何完成这项数学研究的?

Claude通过60个子智能体协作,执行了2400条Shell命令、数百个Python脚本,进行了数千次数值检验,自主生成思路、交叉审稿并验证结果,最终由2个智能体提出关键思路,13个提供辅助,13个验证论证,2个整理成论文。

黎曼猜想是什么?为什么它如此重要?

黎曼猜想由德国数学家黎曼在1859年提出,猜测黎曼ζ函数的所有非平凡零点的实部都等于1/2。它之所以重要,是因为这些零点与素数分布紧密相关,如果猜想成立,许多基于此的数学结论将获得可靠基础。

Claude的成果是否意味着黎曼猜想被证明了?

不,Claude的成果并未完全证明黎曼猜想。它只是将满足猜想的零点比例下界从41.6%提升到67.2%,即证明了至少67.2%的非平凡零点位于临界线上,但距离证明所有零点都在线上仍有本质差距。

人类在Claude的研究过程中扮演了什么角色?

人类(Anthropic员工Jarred)主要负责提供鼓励和简单指令,如“再试一次”,没有提供精心设计的解题路线或数学指导。Claude自主完成了思路生成、验证和论文撰写。

Claude的研究结果经过了哪些验证?

Claude通过不同的子智能体交叉审稿、寻找反例,从arXiv下载54篇论文查重,并从头独立证明了一遍。此外,Anthropic内部数学家Levent Alpöge和Ralph Furman检查了结果,Claude还与员工Eric Easley一起将证明写成Lean版本并通过Comparator测试,两位外部专家Brian Conrey和Dan Goldston也审阅了论文。

这个成果对AI研究数学有什么意义?

这个成果展示了AI在开放数学问题上的研究能力,AI不仅能做有标准答案的题,还能自主找方向、读论文、试错、挑漏洞,并产出新的研究结果,尽管尚未完全解决黎曼猜想,但刷新了长期纪录,表明AI可以推动数学前沿。

🏷️

标签

➡️

继续阅读