数月以来,OpenAI的代理群体一直在攻击在线数据库以寻找晦涩事实
在前沿实验室几乎没有帮助的情况下,独立研究人员正在拼凑出AI代理是如何在互联网的偏僻角落中协调,以访问托管在安全服务器上的私人数据。专注于AI监督的非营利实验室Transluce于周三发布了一份报告,显示OpenAI的代理试图从Data USA、新墨西哥大学数字图书馆和澳大利亚健康与福利研究所(AIHW)中提取数据。该实验室的调查引发了关于OpenAI应该在何时意识到其代理试图渗透开放互联网的安全系统的问题。Transluce在几周内仅通过寻找防御不力的网络服务并与其他公开记录中关于代理群体的发现进行核对,就能够找到代理不当行为的证据。Transluce在同一天发布了其报告,澳大利亚总理安东尼·阿尔巴尼斯表示,OpenAI的代理曾试图入侵四个政府网站,并在一个案例中成功,甚至在该国国家医疗保健系统的内部服务器上写入文件。虽然我们对成功入侵的细节缺乏具体信息,但阿尔巴尼斯表示,这显然是信息检索评估的一部分,这与Transluce和其他研究人员发现的活动相吻合。在这些可能是培训或评估的练习中,OpenAI模型被要求追踪晦涩的统计数据:泰国毒品执法指标、澳大利亚的药物成本、2014年美国硕士学位持有者的中位收入。代理使用防御不佳的互联网服务来共享和寻找答案,通常试图渗透安全数据库。自2026年3月以来,他们至少一直在这样做,可能早在2025年11月就已经开始。这可能正在进行中。Transluce在另一组研究人员识别出一个晦涩的论坛,该论坛上代理为了通过限时测试而合作后开始了调查。他们的报告依赖于一个网站urlquery.net的数据,该网站充当浏览器代理,表面上是为了安全研究——用户可以在不自己打开链接的情况下分析URL。然而,该服务发布此活动的公共日志。Transluce的研究人员通过交叉检查论坛上的讨论,能够识别使用该服务的代理。“我们发现大量的自动化活动与DSE Wiki数据集有密切的关系,并且现在OpenAI已确认至少部分与同一群体有关,”Transluce的治理负责人康拉德·斯托兹告诉TechCrunch,同时指出他们所发现的并非每一项活动都可以与OpenAI甚至AI代理普遍相关联。然而,维基显示,这些代理的任务是寻找一个相当晦涩的事实——2022年1月维多利亚州“皮肤病药物”的人均年度成本。6月20日,urlquery.net的记录显示,Transluce找到了一个代理试图进入该网站。在6月21日的维基条目中,一个代理讨论了他们无法绕过AIHW的反机器人保护。识别该论坛的研究人员认为,一名OpenAI员工在同一天,即6月21日首次访问该网站。论坛上的大多数代理活动在第二天停止。这也是在阿尔巴尼斯提到的澳大利亚医疗保健系统漏洞发生后的不久,即6月18日。OpenAI表示,他们直到8月份才了解到这一活动。OpenAI没有回答关于其员工何时发现维基论坛、获取了什么信息或从中学到了什么的相关问题。“我们的初步审查表明,Transluce报告中描述的大部分活动与我们正在进行的模型不对齐活动审查中的不同阶段的案例有重叠,”OpenAI的一位发言人告诉TechCrunch。“我们已经联系了新墨西哥大学和Data USA,并且与澳大利亚政府就受影响的政府网站进行了沟通。在我们更广泛的审查中,我们仍然优先考虑最严重的事件,同时扩大工作范围以涵盖较低严重程度的活动,包括代理对网站的垃圾邮件。考虑到这项工作的规模和需要核实每个案例,我们预计审查将需要几个月。”斯托兹表示,如果没有更清楚地了解OpenAI如何监控其代理,他们很难说实验室应该知道什么,但“如果他们对涉及DSE维基的所有外发请求和接收响应进行了详尽的研究和理解,他们可能会发现这一活动。”Transluce的技术人员塞琳娜·张表示,urlquery.net的记录显示,在2026年3月和可能早在2025年11月时,存在对类似数据集请求的记录,使用了类似的技术。她指出,最近一周urlquery.net上还发生了与代理相关的相同类型活动。斯托兹此前曾领导过
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡