未发布的Anthropic模型在数学上最大的未解问题之一上取得进展
超过150年来,黎曼假设一直是数学界主要的未解问题之一,这是一个关于素数分布的长期谜题。目前,针对该假设的有效一般证明有100万美元的奖励,但至今无人认领。当前的人工智能模型同样无法解决该问题,但它们可以取得比你想象中更多的进展,这一发现可能会重新引发关于当代人工智能发现新科学和数学思想的能力的长期讨论。周一,Anthropic宣布一个尚未发布的模型在黎曼假设上取得了显著进展,显著提高了该假设成立的解的下限。更令人印象深刻的是取得进展的方式:一名没有显著数学训练的Anthropic员工促使该模型“真正尝试”证明该假设,然后让模型在接下来的一天半中协调任务。总的来说,该模型测试了650种不同的解决问题的思路,协调了60个子代理,并总共花费了3100万美元。论文的脚注解释,“在60个子代理中,有两个负责发展关键数学思想,13个为这些代理提供了想法,30个尝试(但未能)发展新想法,13个作为验证者检查论证的正确性,最后两个帮助撰写初步论文。”这一发现得到了两位Anthropic内部数学家的确认,并使用开源证明助手Lean进行了形式化。这是大型语言模型(LLM)主导的一系列数学突破中的最新成果。今年内,一些厄尔多斯问题已被人工智能模型解决,越来越强大的模型的发布也带来了更加令人印象深刻的结果。OpenAI最近发布了一组由其内部“Astra”模型证明的十个主要结果,而Anthropic的一个独立努力则驳斥了长期存在的雅可比猜想。不断增加的成果令数学界既兴奋又担忧。在六月签署的公开声明中,一群著名数学家表达了对人工智能可能破坏该领域关键价值观的担忧,尤其是认为真正的数学证明应归功于“应对其发现承担责任的特定作者”。但在数学界内,人们对数学家应如何看待新研究技术仍存在分歧。在回应声明的博客文章中,菲尔兹奖得主提摩西·高尔斯质疑人工智能的影响是否可能以更加复杂和积极的方式改变数学。“如果我们来到一个数学定理不再与数学家相关的世界,也许这不会比明星不以天文学家的名字命名而大多数也根本不命名更有问题,”高尔斯写道。当你通过我们文章中的链接购买时,我们可能会获得少量佣金。这不影响我们的编辑独立性。拉塞尔·布兰登自2012年以来一直报道科技行业,重点关注平台政策和新兴技术。他曾在《The Verge》和《Rest of World》工作,并为《Wired》、《The Awl》和MIT的《Technology Review》撰稿。他可以通过电子邮件联系 russell.brandom@techcrunch.com,或在Signal上联系412-401-5489。查看个人简介
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡