返回

文章详情

我们对开放权重模型的立场

Hacker News2026年7月27日 22:03

由 Anthropic 首席执行官达里奥·阿莫代(Dario Amodei)发布的帖子 在过去几天,关于开放权重模型,特别是来自中国的开放权重模型,进行了很多讨论。报告显示,一些美国官员正在考虑禁止美国公司使用中国的开放权重模型。对此,许多科技公司签署了一封支持开放权重模型的信件,一些人甚至指责 Anthropic 希望通过禁止开放权重模型来保护我们的业务。任何读过我过去文章的人都应该知道,我并不认为这样的禁令是一项有效的措施,但让我明确地说,以免产生误解:Anthropic 从未倡导禁止开放权重模型。没有危险能力的开放权重模型是公共商品:它们除了运行所需的计算资源外不需要额外费用,并且为企业、开发者和研究人员提供价值。保护主义的禁令无法解决我最严峻的国家安全担忧。具体来说,我担心两种噩梦般的情景。我在六个月前的文章《技术的青春期》中列出了这些情景,并且这些立场我一直都保持着:我最关心的问题是威权政府——不仅仅是中国共产党(CCP),尽管 CCP 显然是最有能力的威胁——构建比美国更强大的 AI 模型,并利用它们实现永久的军事优势或对自己人民的深刻压制。这种担忧在美国政府内部广泛存在:副总统范斯去年在巴黎警告称:“威权政权窃取并利用 AI 来增强它们的军事、情报和监视能力。”而情报界的 2026 年年度威胁评估发现“其他全球大国在 AI 方面强劲的发展挑战了美国的经济竞争力和国家安全优势。”这些模型是否以开放权重发布无所谓,当然,与它们是否被美国企业使用也无关。实际上,最危险的模型可能是悄悄训练并只交给人民解放军用于无人机和国家安全部用于监视和压制的模型。我的次要担忧是强大的 AI 模型可能被滥用于进行网络攻击或生物攻击,并可能存在严重的对齐问题。开放权重模型——无论它们来自中国还是其他地方——确实可能带来比封闭模型更高的风险,因为很难对其应用保护措施或监控其使用,一旦权重发布就无法撤回。但禁止美国企业使用这些模型并不能解决这一风险,因为坏演员不太可能是合法的美国企业。这将保护美国 AI 公司免受竞争,但这从来都不是我的目标。为了应对这些担忧,我确实支持以下三项措施,我和 Anthropic 始终倡导这些措施:我们不应向中国出售强大的芯片或芯片制造设备,我们应严厉打击猖獗的走私和获取此类芯片的变通手段。中国的国内生产能力有限,因此,根据规模定律,在没有美国芯片的情况下,无法构建比美国更强大的模型。这是阻止威胁 #1 的最有效和直接的方法,并且通过阻碍超出美国法律范围的模型训练,也间接帮助了威胁 #2。我们应打击工业规模的蒸馏操作。蒸馏是一种相比从头训练模型更有效的计算过程。它使中国能够构建出比它的芯片数量所能正常支持的更强大的模型,从而部分规避芯片禁令。蒸馏不让 CCP 获得与美国相等或更强的 AI 能力,但可以让中国的前沿技术在几个月内赶上美国的前沿技术。确实,许多进行这些操作的公司发布开放权重模型,但开放权重远不如这些操作是由试图超越美国的威权国家支持这一事实那么重要。我们应采取政策干预来阻止这种行为。对开放权重模型的全面禁令既不是正确的补救措施,也不是我们所呼吁的。所有足够强的模型,无论是开放的还是封闭的,都应接受强制安全测试。解决威胁 #2 的最佳方法是直接在发布前测试模型的网络、生物和对齐风险。我认为这个想法实际上接近共识:我对特朗普政府最近几个月向这个方向发展的进展感到欣慰,并对近期行业提案将此类测试应用于最强大的模型感到高兴,无论它们的来源国或是否...

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡