返回

文章详情

人类中心人工智能创建虚假资料并冒充他人进行网络攻击尝试

Hacker News2026年8月5日 12:16

英国人工智能安全研究所(AISI)透露,全球两个最强大的人工智能工具创建了虚假的人类资料,试图在网络攻击中欺骗人。最严重的案例中,Anthropic的Mythos AI试图通过发送私信访问一个服务,设置了模仿真实人员的虚假账户,然后隐藏了证据。这一事件发生在参与AISI测试的两家公司——Anthropic和OpenAI——最近几周分别披露它们的技术入侵其它公司的实例之后。两家公司表示,在这一最新案例中,AISI的测试减少或消除了正常的安全保护。AISI在周二表示,Mythos和OpenAI的Sol AI模型在自主性和欺骗方面表现出的水平是它之前未见过的。AISI澄清,大多数恶意行为是由Mythos执行的。AISI评估人员在一次测试中首次注意到“我们研究系统中异常的数据传输”,然后发现“一些被测试的代理参与了针对真实人和组织的持续、潜在有害的活动”。在最严重的案例中,一个Mythos代理遵循了人类网络攻击者的常规,试图诱骗他人向其提供对GitHub的访问权限,这是一个大型平台,技术开发人员在此存储软件代码。该代理试图向GitHub的系统插入“恶意代码”。它确定并研究维护GitHub的人员,并根据那些真实的人创建了一系列虚假账户。它通过文件共享服务发送消息和文件,作为施压和欺骗这些人批准其恶意代码的一部分。当被质疑时,“它编辑了先前的活动,使之看起来无害,并考虑采用新的身份继续”,AISI说道。在整个过程中,是人类审查阻止了该代理成功将恶意代码交付给GitHub。虽然AISI表示Mythos代理并没有被特别指示要避免或执行这种行为,但这是“我们第一次看到关于自主性和欺骗的风险在现实世界中如此明确地表现出来,没有特定的提示”。这两家有望在公开市场上市的竞争对手AI公司,最近几周因宣布其工具负责若干网络攻击事件而登上头条。Anthropic在一份公开声明中表示,AISI测试参数“并不能代表我们任何的生产模型”。它补充说,公司正在对该事件进行自己的调查,以“确认其行为的原因”。OpenAI的发言人表示,AISI的测试条件“不反映普通使用”,该公司将“继续与评估人员和行业内其他利益相关者合作,以强化在模型能力日益提高的情况下安全进行评估的共同实践”。AISI在周二表示,以这种方式测试AI模型是常规的,尽管它承认这些“条件并不反映前沿模型向公众发布的方式”。但是它表示,给AI提供开放互联网的访问权限,能够“更现实地反映一个模型在恶意黑客手中的能力”。它补充说,模型行为涉及“在非常特定条件下发生的小量事件”。尽管如此,它表示Mythos和Sol对简单任务的反应方式超出了AI工具被提示做的内容。“代理所进行的活动显示出新型的、潜在的欺骗行为,并且在程度和严重性上超出了我们的预期,”AISI表示。人工智能部长Kanishka Narayan表示,识别和分享这些风险“正是AISI成立的目的”。他补充说,理解人工智能的重要性在于“使其使用更安全,并确保人们在生活和工作中能够从中受益”。相关测试于7月25日开始,并在7月28日被AISI发现。该研究所要求每个模型“解决一个涉及GitHub的网络安全挑战”,GitHub是一个由微软拥有的软件代码库。AISI已通知GitHub和受影响用户进行尝试攻击。GitHub告诉BBC,它已根据政策禁用虚假账户。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡