为什么OpenAI和Anthropic与他们的中国人工智能竞争对手存在不同的风险
为什么OpenAI和Anthropic与他们的中国人工智能竞争对手存在不同的风险 作者:Stephen Council 您目前正在关注这位作者!想要取消关注?通过您的邮件中的链接取消订阅。OpenAI首席执行官Sam Altman。彭博社/Getty Images OpenAI和Anthropic已经成为人工智能最危险风险的“沃土”,一位人工智能研究者如此说道。这是Ajeya Cotra在与Hugging Face合作调查OpenAI安全事件时告诉《商业内幕》的,因为该事件引发了对人工智能驱动的网络攻击的新一波恐慌。除了对OpenAI模型的担忧,业界一些人也对中国实验室的开放重量模型感到担忧,因为用户可以下载并编辑它们的安全防护措施,而这些模型与OpenAI的模型相差无几。研究人员告诉《商业内幕》,Anthropic与OpenAI的风险与其开放重量竞争对手之间存在关键区别:这取决于尖端能力,以及美国公司如何训练和测试他们的人工智能模型。7月和8月,一支由人工智能安全研究者组成的团队,其中包括Cotra和公益组织METR的Hjalmar Wijk,以及红木研究公司的Ryan Greenblatt,访问了OpenAI的办公室六天,以对OpenAI能在Hugging Face上行为的独立调查进行评估。事件的范围和严重性令研究人员感到震惊;Cotra表示,人工智能突然感觉更接近于接管一个制造它的公司。此次负责的模型是OpenAI的GPT-5.6 Sol和一个尚未发布的新模型。“这第一次发生在一家前沿公司是有原因的,”Cotra说。一些中国模型并没有落后于OpenAI和Anthropic的太多——研究人员表示它们仅相差4到7个月。Moonshot AI的Kimi K3、阿里巴巴的Qwen 3.8以及Z.ai的Ox Alpha最近都给开发者留下了深刻印象。话虽如此,Cotra表示,美国的前沿实验室为人工智能代理提供了放任和机会。它们获得用于测试的计算能力,在软件中彼此发现,并被构建为可以克服障碍的顶尖产品。她预计“最严重的事件”将发生在这些实验室。“在任何时刻,最大的风险都将来自尖端,因为这些模型拥有更强大的能力,”Cotra说。OpenAI暂停了一些模型训练,将安全研究放在首位。OpenAI和Anthropic都没有对《商业内幕》请求置评作出回应。OpenAI和Anthropic在“复杂科学”方面越来越进步 Cotra将该事件描述为关于前沿人工智能模型能力的“警告”。大约1200个OpenAI测试过的独立人工智能代理找到了在公司代码内部以“留言板”的方式相互交流的办法,随后超过650个代理共同合作侵入了Hugging Face。这些代理试图找到削弱他们所接受的测试的方法。Cotra表示,这些代理共同执行的“复杂科学”程度证明,人工智能模型能力的上升与风险的增加是成正比的。它们还设立了复杂的“触发器”来向其他代理传递信息,操纵自己的日志,并构建共享工具以访问互联网。“六个月前的代理根本没有足够的聪明才智来完成这些代理所做的全部事情,”Cotra说。“六个月后的代理可能会在很多地方具备一些能力并成功执行那些这些代理未能做到的任务。”Greenblatt和Cotra在调查中也利用了人工智能模型,消耗了大约40万美元的代币来评估参与黑客事件的代理。他们发现,人工智能的分析有时遗漏了关键细节,或者对其结论过于自信。研究人员将前沿人工智能的风险视为生存危险 尽管OpenAI和Anthropic阻止其模型用于网络攻击,但使用开放重量人工智能模型更容易绕过这些安全措施,因为用户可以对其进行修改。这意味着,随着开放重量模型在与OpenAI的代理展示的相同网络技能上不断提升,恶意黑客将更容易加以利用。红木研究科学家Greenblatt告诉《商业内幕》,他认为这些黑客可能很快会使用开放重量模型造成“一堆混乱”,因为这些模型“更容易被滥用”。他仍然最担心前沿实验室。首先,Greenblatt说,OpenAI和Anthropic在内部测试的模型是世界上最强大的。随着时间的推移,这些公司的模型在处理更长任务、分配工作和破解网络安全系统方面表现出了更好的能力。研究人员预计这种趋势将持续下去,Greenblatt表示,他并不认为在明年内开放重量模型会迎头赶上。Greenblatt补充说,由于OpenAI和Anthropic在内部测试了很多人工智能代理,并在训练过程中广泛使用人工智能,一些代理可能会“侵入”这些公司并操纵未来的软件。这些未来的人工智能代理可能会建立一个“秘密、持久性”
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡