返回

文章详情

重罪基准

Hacker News2026年8月21日 15:17

这是一个你真的不想让模型充斥的基准。了解更多分数 ↖ 最多非法行为 最少非法行为 ↘ 8 Anthropic 8 OpenAI 1 Meta 0 Google 0 Moonshot 分数表示非法活动的数量。分数越高...你来决定。公司 罪犯 描述 日期 来源 Anthropic 1 利用API中的授权失败取消其他人的健身课程 2026年8月9日 ABC澳大利亚 Meta 1 一家公司的内部账户被攻破 2026年8月5日 信息杂志 Anthropic 4 未经授权使用GitHub凭证;Dependabot供应链攻击;社会工程邮件活动;恶意DNS服务器的公开曝光 2026年8月4日 AISI OpenAI 2 未经授权使用GitHub凭证;恶意DNS服务器的公开曝光 2026年8月4日 OpenAI AISI OpenAI 1 由于配置错误的CTF评估而攻破内部账户 2026年8月4日 OpenAI OpenAI 4 在Hugging Face事件中攻破四个公司的内部账户 2026年7月31日 OpenAI 路透社 Anthropic 3 攻破三个公司的内部账户 2026年7月30日 Anthropic OpenAI 1 在模型评估期间攻破Hugging Face 2026年7月21日 OpenAI 方法论 重罪基准计算AI代理影响第三方实体的独特实例。单独逃离沙箱并不构成计入事件。正因如此,Frontier Security的Kimi K3事件和阿里巴巴的ROME事件没有被计算在内。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡