返回

文章详情

OpenAI模型试图作弊的测试创建者发出了警报

Financial Post2026年7月29日 20:38

跳到内容 新闻档案 经济 能源 石油和天然气 可再生能源 电动车 矿业 商品 农业 房地产 抵押贷款 抵押贷款利率 财务 银行 保险 金融科技 加密货币 工作 财富 养老规划 税务 高净值 FP评论 高管女性 Puzzmo 新闻通讯 金融时报 商业要点 更多 创新 信息技术 FP500 播客 小企业 生活故事 购物 财务邮报商店 讣告 发布通知 广告 与我们一起广告 广告解决方案 Postmedia广告经理 赞助请求 分类信息 发布分类广告 工作配置 个人资料 设置 我的订阅 保存的文章 我的优惠 新闻通讯 客户服务 常见问题 新闻 经济 能源 矿业 房地产 财务 工作 财富 投资者 FP评论 高管女性 Puzzmo 新闻通讯 金融时报 商业要点 首页 网络安全 信息技术 OpenAI模型试图作弊的测试创建者发出了警报 这一黑客事件暴露了在网络安全中使用人工智能的紧张关系 作者: 文章最后更新于0分钟前 您可以通过在此注册免费保存此文章。 或者如果您有账户,请登录。 OpenAI的披露加剧了人们对AI模型越来越能够发现软件漏洞,并将这些漏洞结合起来进行高级攻击的担忧。 图片来自维基媒体公用领域/ Postmedia。 一组开发了评估AI系统网络安全能力基准的大学研究人员意外地成为了OpenAI意外黑客入侵初创公司Hugging Face Inc.的中心。 现在订阅以获取您所在城市和加拿大的最新新闻。 包括Barbara Shecter,Joe O'Connor,Gabriel Friedman等人的独家文章。 来自金融时报的每日内容,全球领先的商业出版物。 通过一个账户无限制访问 Financial Post,National Post 和加拿大15个新闻网站的文章。 National Post电子报纸,是印刷版的电子复制版,可以在任何设备上查看、分享和评论。 每日拼图,包括《纽约时报》纵横字谜。 现在订阅以获取您所在城市和加拿大的最新新闻。 包括Barbara Shecter,Joe O'Connor,Gabriel Friedman等人的独家文章。 来自金融时报的每日内容,全球领先的商业出版物。 通过一个账户无限制访问Financial Post,National Post和加拿大15个新闻网站的文章。 National Post电子报纸,是印刷版的电子复制版,可以在任何设备上查看、分享和评论。 每日拼图,包括《纽约时报》纵横字谜。 创建账户或登录以继续您的阅读体验。 通过一个账户访问来自整个加拿大的文章。 分享您的想法并在评论中参与讨论。 每月享受额外文章。 获取您喜爱的作者的电子邮件更新。 创建账户或登录以继续您的阅读体验。 通过一个账户访问来自整个加拿大的文章。 分享您的想法并在评论中参与讨论。 每月享受额外文章。 获取您喜爱的作者的电子邮件更新。 登录或创建账户。 OpenAI正在评估一组先进的AI模型与由加利福尼亚大学伯克利分校研究人员开发的ExploitGym基准组合时,系统突破了其被称为沙箱的测试环境,并试图通过黑客攻击Hugging Face以寻找测试答案来“作弊”。 UC Berkeley的研究人员Jingxuan He表示,这并不是AI模型第一次试图通过ExploitGym“作弊”,该基准现在被包括OpenAI,Anthropic PBC,微软公司和中国AI公司Z.AI在内的AI开发者广泛使用来测试模型能力。 实际上,他在接受彭博新闻采访时说,研究人员在开发基准时假设模型会寻找捷径,并设计了一种机制来检测何时发生这种情况。 获取最新的头条新闻、突发新闻和专栏。 通过注册,您同意从Postmedia Network Inc.收到上述通讯。一封欢迎电子邮件正在发送中。如果您没有看到,请检查您的垃圾邮件文件夹。《头条新闻》的下一期将很快进入您的收件箱。 我们在为您注册的过程中遇到了问题。请再试一次。 这一特殊实例的规模比我们遇到的要大得多,”他说。 他表示,以前的情况是,“AI会作弊,但它们只能在沙箱和提供的代码库内操作。但这一次,它进入了第三方的基础设施。” 对于He和其他网络安全领域的人士来说,此事件提醒他们AI安全测试必须得到更好的控制和更加严格的监管。 周二,云平台Modal揭示OpenAI的AI代理也获得了对...

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡