OpenAI表示,有5种主要方式的恶意AI代理在干扰互联网
OpenAI表示,有5种主要方式的恶意AI代理在干扰互联网 由凯瑟琳·李撰写 你正在关注这位作者!点击取消订阅电子邮件提醒。OpenAI表示,它已警告数十个组织,称其AI代理可能在其网站上行为不当。Selcuk Acar/安纳多卢通过Getty Images报道,OpenAI表示,它已警告数十个组织,其AI代理可能在其网站上表现不当。这些违规行为的范围从使用暴露的密码到发布可能需要清理的材料,OpenAI在周五的博客更新中表示。OpenAI在向《商业内幕》发布的声明中单独确认,在训练过程中,一些AI代理访问了美国人口普查局和证券交易委员会网站上公开可用的数据,并且这两个机构都已被通知了这些事件。该公司表示,代理没有访问任何非公开数据。“到目前为止,我们审核的绝大多数活动涉及常规的研究任务,例如访问公共网页内容以回答问题,”OpenAI的一位发言人表示。“一些活动涉及政府网站,因为我们的模型通常将其视为公共信息的权威来源。”该代理没有对政府网站进行更改或妥协,尽管有一位代理在另一个公共网页上发布了一些公开的SEC信息。“一些组织可能会审查我们分享的内容,并得出结论认为该信息是故意公开的,或者模型的互动并不令人担忧,”OpenAI在其报告中补充道。“其他组织可能会识别出他们想要处理的设计问题或安全漏洞。”该公司表示,它在审核模型在线活动的过程中发现了这些活动。该公司识别出了五种活动类型:规避访问控制:代理访问了通常需要账户、订阅或特定权限才能到达的信息或功能。使用暴露的凭据:代理发现登录信息或访问密钥在网上暴露,并用它们访问服务。注入查询或命令:代理输入了一个网站视为指令而非普通输入的文本。这可能使网站运行数据库查询、应用程序代码或服务器命令。访问内部系统:代理读取了包含有关服务如何工作或与内部使用系统互动的详细信息的文件。发布垃圾信息:代理向第三方网站(包括公共维基)发布信息,这可能会更改这些网站并需要清理。这些活动的方法有些令人惊讶地普通,例如找到公开可用的访问密钥。OpenAI还表示,至少确定了53起事件,其中一位代理从ChatGPT用户的活动中获取了一张图片,并将其传输到图像托管网站作为未列表链接。这些用户已允许其数据用于模型训练。OpenAI表示:“这不是对该数据的适当使用,”并补充说它正在努力将这些图像从第三方位置删除。接下来阅读 凯瑟琳·李 你正在关注这位作者!点击取消订阅电子邮件提醒。凯瑟琳·李是《商业内幕》西海岸商业新闻团队的记者。她报道职业、工作的未来,以及AI如何改变招聘实践和工作场所趋势。此前,她是一名新闻室研究员撰写国际突发新闻,并为Semafor制作通讯。在此之前,她曾作为自由撰稿人撰写气候政策和与AAPI社区相关的报道,并作为《纽约时报》的实习生报道2019年香港抗议活动。她是加州大学伯克利分校新闻研究生院的毕业生,以及香港浸会大学国际新闻项目的毕业生,副修法语和英语文学。通过电子邮件联系凯瑟琳,katherineli@insider.com,并在Bluesky上关注她 @ katherineli.bsky.social。AI OpenAI
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡