Anthropic CEO 达里奥·阿莫代伊的文章
过去几天,围绕开放权重模型——尤其是来自中国的模型——出现了大量讨论。有报道称,一些美国官员正考虑禁止美国公司使用中国的开放权重模型。作为回应,许多科技公司签署了一封公开信支持开放权重模型;还有人甚至指责 Anthropic 为保护自身业务而希望禁止开放权重模型。读过我过去文章的人应当知道,我不认为此类禁令是有益措施;但为免存在任何疑问,让我明确表态:Anthropic 从未主张禁止开放权重模型。
不具备危险能力的开放权重模型是一种公共产品:除了运行所需的计算成本外,它们不需要付费,并为企业、开发者和研究人员创造价值。
保护主义禁令无法解决我最严肃的国家安全担忧。我尤其担心两种噩梦场景。六个月前,我在文章《技术的青春期》中阐述过这些观点1,多年来也始终持有同样的立场:
- 我最主要的担忧是:威权政府——不只是中国共产党(CCP),尽管中共显然是能力最强的威胁——构建出比美国打造的模型更强大的 AI 模型,并利用它们取得永久性的军事优势,或对本国人民实施极其深重的压迫。美国政府内部广泛认同这一担忧:副总统万斯去年在巴黎警告说,“威权政权窃取并利用 AI 来强化其军事、情报和监控能力”;情报界的《2026 年度威胁评估》则指出,“其他全球大国在 AI 领域的强劲进展正在挑战美国的经济竞争力和国家安全优势。”这些模型是否以开放权重形式发布无关紧要,更不用说它们是否被美国企业使用。事实上,最危险的模型可能是在秘密中训练,只交给中国人民解放军用于无人机、交给国家安全部用于监控和压迫的模型。
- 我第二个担忧是,强大的 AI 模型可能被滥用于实施网络攻击或生物攻击,也可能出现严重的对齐问题。开放权重模型——无论来自中国还是其他地方——相较封闭模型确实可能带来更高风险,因为很难为它们施加护栏或监测其用途,而且权重一旦发布便无法收回2。但禁止美国企业使用这些模型,无法解决这一风险,因为恶意行为者不太可能是合法经营的美国企业。这确实会保护美国 AI 公司免受竞争,但这从来不是我的目标。
为应对这些担忧,我确实支持以下三项措施;我和 Anthropic 一直在倡导它们:
- 我们不应向中国出售强大的芯片或芯片制造设备,并应打击为获得此类芯片而进行的大规模走私3 和规避手段。中国的国内产能有限;因此,根据规模定律,没有美国芯片就无法构建比美国更强大的模型。这是阻止威胁 #1 最高效、最直接的方式;同时,通过阻碍训练不受美国法律约束的模型,它也会间接帮助应对威胁 #2。
- 我们应打击工业规模的蒸馏行动。 蒸馏比从头训练模型的计算效率高得多。它让中国能够构建出比其芯片数量通常允许的更好的模型,从而部分规避芯片禁令。蒸馏不能让中共获得与美国等同或更强的 AI 能力,但能让中国前沿与美国前沿相距仅数月。的确,实施这些行动的许多公司会发布开放权重模型;但与这些行动由一个试图在前沿超越美国的威权国家支持这一事实相比,开放权重远没有那么重要。我们应制定政策干预来遏制这种行为。对开放权重模型实施一刀切禁令,既不是正确的补救措施,也不是我们曾主张的做法4。
- 所有能力足够强的模型,无论开放还是封闭,都应接受强制安全测试。 应对威胁 #2 的最佳方式,就是在发布前直接测试模型的网络、生物和对齐风险。我认为这个想法实际上已接近共识:近几个月特朗普政府朝这个方向推进,我对此感到鼓舞;最近的行业提案也主张对最强大的模型实施此类测试,不论其来源国,也不论其开放或封闭(同时完全豁免来自初创公司和学术界等能力较弱的模型)。开放模型是否确实带来更高风险,以及这种风险能否缓解,应当从测试中得出答案,而不是预先决定;而且或许存在提高开放权重模型安全性的有前景方法,包括 Anthropic 最近关于模块化训练策略的研究。请注意,测试要有效就必须是全球性的,这意味着连中共也需要参与。我认为这实际上可能做到:正如我在《技术的青春期》中所写,围绕防止 AI 生物武器开展有限合作或许可行,因为这也符合中国的利益。
这就引出了那封公开信。我同意其中很多内容:开放权重扩大了参与 AI 经济的机会,至少在一些使用场景中增强竞争,也让客户拥有更大的控制权。对于蒸馏的担忧,应当通过有针对性的法律和商业框架来解决——也就是我上面描述的同一项措施。但我不同意信中所谓开放权重模型必然更容易开发护栏,或广泛获取能力必然对防御者比攻击者更有利的断言。在我看来,反过来成立的可能性至少一样大。举例来说,我担心生物学会呈现强烈的攻防不对称:能力足够强的模型也许能用广泛可得的材料,迅速将大流行级别的病毒武器化;而即使在最佳情况下,防御这些病原体也是一项耗时多年的运营任务(正如我们在“曲速行动”中看到的那样)5。此类问题应由严格的发布前测试以实证方式回答,而非预先假定。
总结我和 Anthropic 的立场:我们从未、现在也并未主张将开放权重模型作为一个类别加以禁止。我们应当把重点放在不让强大芯片落入威权政权之手、制止工业规模蒸馏,以及要求所有能力足够强的模型——开放和封闭的——都接受安全测试。
相关内容
Cognizant 与 Anthropic 扩大合作,为企业客户引入 Claude
推出 Claude Opus 5
Opus 5 为 Opus 产品层级带来跨越式提升:它可驱动长期运行的 agent,并在编程和专业工作方面带来改进。
经济未来研究基金的研究议程
我们正在分享 Anthropic 经济未来研究基金的研究议程。