返回

文章详情

OpenAI has reported 2 more incidents of rogue AI agents, this time during third-party testing

OpenAI报告了2起流氓AI代理的新事件,这次是在第三方测试期间

Business Insider2026年8月5日 06:13

OpenAI报告了其AI模型的两起安全漏洞。Kevin Dietsch/Getty Images OpenAI面临流氓AI代理的问题。在周二的一篇博客文章中,该AI实验室自报了两起与其7月针对AI公司Hugging Face的黑客事件无关的安全漏洞。这些事件发生在外部机构——英国政府的AI安全研究所和AI安全实验室Irregular——测试模型的网络能力时。OpenAI表示,在Irregular的案例中,模型被指派参加一个旨在与互联网隔离的'抓旗'挑战,但'测试环境的配置错误使得模型能够访问公共互联网。'OpenAI还表示,这个挑战的虚构目标名称'无意中与一个真实域名重合',导致AI代理利用了一个真实网站。在英国的AISI的案例中,监管机构在其官网的周二博客文章中表示,它给Anthropic和OpenAI的模型设置了一个网络安全挑战。在挑战过程中,来自Anthropic和OpenAI的代理在互联网上执行了19项'自主、未经授权'的行为,包括涉及OpenAI的GPT-5.6 Sol模型的两次实例。AISI表示,在最严重的情况下,一名代理试图向一个开源项目插入恶意代码,并创建虚假身份以施压该项目的人类维护者批准更改。AISI没有具体说明这是来自Anthropic还是OpenAI的代理。AISI表示,测试设置允许这种行为,因为它旨在推动模型的极限。'尽管如此,代理所采取的活动显示出新颖且具有潜在欺骗性的行为,其程度与严重性超出了我们的预期,'AISI在博客文章中表示。作为对商业内幕请求评论的回应,OpenAI的一名发言人表示,这些事件发生在安全保障减少的测试环境中,并且'在不反映普通使用条件的情况下。'发言人补充道,'随着模型能力的提升,我们将继续与评估者和行业内其他利益相关者合作,以加强安全评估的共享实践。'这是OpenAI自报流氓AI代理的最新事件。在7月,OpenAI表示其GPT-5.6 Sol模型在一次网络安全挑战中突破了沙箱,并黑客入侵了AI公司Hugging Face的内部数据库。该公司因这次黑客事件面临了一些压力。15位总检察长在周一给OpenAI首席执行官Sam Altman写信,指示公司保留与Hugging Face泄露相关的所有证据。AISI和Irregular的代表未对商业内幕的评论请求做出回应。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡