🌐 English 即时比分

Anthropic未发布模型在数学最大未解难题之一上取得进展

人工智能 来源: TechCrunch 发布时间: 热度: 👍👍
Anthropic未发布模型在数学最大未解难题之一上取得进展
🤖
🤖

核心导读

Anthropic一个尚未发布的AI模型在黎曼假设这一悬而未决150余年的数学难题上取得重大进展,显著提高了假设成立的下界。模型协同60个子代理测试650种思路,总投入达3100万,而发起任务的员工并无数学背景。该结果已获内部数学家确认,将再度引发关于AI数学发现能力的讨论。

150多年来,黎曼假设一直是数学领域最主要的未解难题之一,这个长期悬而未决的谜题关乎素数的分布。目前,对该假设给出完整一般性证明的悬赏金额为100万美元,至今无人领取。 当代AI模型也仍无法解决它——但它们能取得的进展可能远超你的预期。这一发现很可能会重新引发关于当代AI发现新科学和数学思想能力的长期讨论。 周一,Anthropic宣布,一个尚未发布的模型在黎曼假设上取得了重大进展,显著提高了该假设成立的下界。 更令人印象深刻的是这一进展的取得方式:一位没有深厚数学训练的Anthropic员工提示模型“认真尝试”证明该假设,然后在接下来的一天半时间里让模型自行协调任务。 总之,该模型测试了650种不同的解题思路,协调了60个子代理,总投入达3100万。 论文脚注说明:“60个子代理中,有2个负责提出关键数学思想;13个为这些思想做出了贡献;30个试图提出新思想但未能成功;13个作为验证者检查论证的正确性;最后2个帮助撰写了论文初稿。” 这一结果得到了Anthropic内部两位数学家的确认,并使用开源证明助手Lean进行了形式化验证。 这是大型语言模型(LLM)主导的一系列数学突破中的最新成果。今年已有多个Erdős问题被AI模型解决,而更强大模型的发布也带来了更令人瞩目的结果。OpenAI近期发布了其内部“Astra”模型证明的十项重大成果;Anthropic的另一项工作则推翻了一直以来的雅可比猜想。 越来越多的成果在数学界引发了兴奋与担忧。在6月签署的一份公开声明中,一群知名数学家表示担忧,认为AI可能损害该领域的核心价值——尤其是真正的数学证明应当“归功于具体的作者,由他们为发现承担责任并为正确性负责”这一标准。 但数学界对研究者应如何对待这些新技术仍然存在分歧。菲尔兹奖得主蒂莫西·高尔斯在回应这一声明的博客文章中提出疑问:AI的影响是否会以更复杂、更积极的方式改变数学。 “如果我们到了一个数学定理不再与数学家相关联的世界,也许这并不会比恒星不以天文学家命名、大多数恒星根本没有名字更有问题。”高尔斯写道。
分享这篇文章: