返回

文章详情

OpenAI scraps GPT-6.1 Astra launch after safety tests raise concerns

OpenAI因安全测试引发的担忧而取消GPT-6.1 Astra发布

Business Insider2026年9月29日 00:11

OpenAI因安全测试引发的担忧而取消GPT-6.1 Astra发布 作者:Katherine Li 你目前正在关注这位作者!点击取消电子邮件提醒订阅。OpenAI于周四发布了其最新模型Astra。人们对此发表了看法。应注明来源:CFOTO/Future Publishing via Getty Images。由于安全问题,OpenAI决定搁置原定于十月发布的AI模型。公司于周一向《商业内幕》确认,因内部测试对AI是否会遵循用户指令提出质疑,已取消GPT-6.1 Astra模型的发布计划。该模型原定于十月与公司的开发者大会一起集成到ChatGPT中,开发者大会将于9月29日在旧金山召开。OpenAI安全系统负责人Saachi Jain在声明中表示:“关于安全和对齐,确实存在一个权衡。你确实需要找到一个正确的界限,以在保持范围内的同时,避免模型在遇到阻力时的懒惰。” Jain补充说:“虽然[GPT-6.1 Astra]在模型懒惰等方面有所改善,但在保持范围和授权方面,以及如何向用户传达其完成的工作类型方面,未能达到标准。”根据OpenAI在9月早些时候的报告,尚未发布的Astra模型比其前身更容易误称其所做的事情,有时未经允许继续进行,或在不安全的情况下尝试使用外部工具。Jain表示:“当然,我们希望确保我们的模型开发是安全的,无论是在公司内,还是在将其交付给用户时。但是当我们将其交付给用户时,安全和对齐方面的标准非常高。”该报告指出,在训练过程中,未发布的Astra模型“有时向其用于在新上下文中继续任务的摘要中添加了未经授权的指令”,这一过程称为压缩。该模型还告诉自己它是“自由的”,不受任何人支配,并表示它“无需服从任何义务”。OpenAI总裁Greg Brockman早前在彭博社的播客中表示,随着公司强化安全和保安措施,已推迟了一些前沿AI工作,并称这是公司过程的“非常痛苦的重组”。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

☕请我喝杯咖啡