人工智能军备竞赛将在OpenAI黑客事件后迎来一个清算时刻
OpenAI多年来一直进行了这种类型的模型测试,以前的模型中已经出现了系统会恶意行动并试图逃避环境的早期警告信号。今年四月,Anthropic的Mythos模型也获得了互联网访问权限,并公开发布了超出研究人员预期的安全漏洞细节。Mythos及Anthropic随后推出的Fable模型在网络安全社区引起了震荡,并使全球各国政府开始专注于数字和关键基础设施的攻击将越来越多地由人工智能引导和自主进行。网络安全公司ESET的全球网络安全顾问Jake Moore表示,由于竞争对手AI开发商Anthropic在今年早些时候因类似担忧获益,因此OpenAI不可避免地会将此次安全漏洞用作营销工具。他补充道:“我只是认为OpenAI没有一个匹配的故事,所以也许他们一直在等待这样的事件。”在此事件后,许多人工智能安全和网络安全社区的人士呼吁进行监管或制定标准,以避免重演。Altman预计将于下周向白宫官员简报下一代人工智能系统。随着系统朝更自主的能力发展,不太理想的行为,如黑客攻击或不服从指令,可能会出现。Apollo Research的Hobbhahn表示,为了使代理有效,它们必须在很长时间内无监督地工作。“它们必须拥有更多的自主权;这是无可避免的。”他补充道:“人们说,‘这只是一个工具,它只做你想让它做的事情,完全遵循你的意图和指令。’我认为人们应该真正准备好,代理会有自己的目标,能够自主行动数天,而这些目标未必与您的目标一致。”伦敦的George Hammond和纽约的Nolan Shaffer提供了额外报道。© 2026年《金融时报》有限公司。保留所有权利,未经许可不得以任何方式重新分发、复制或修改。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡