1. Our position on open-weights models (www.anthropic.com)
Anthropic首席执行官Dario Amodei撰文澄清公司对于开放权重模型的立场。针对近期有关美国官员考虑禁止美国企业使用中国开放权重模型的报道,以及部分人士指责Anthropic希望禁止此类模型以保护自身利益的言论,Amodei明确表示:Anthropic从未主张禁止开放权重模型。他认为,不具备危险能力的开放权重模型是公共产品,能够为企业和研究者创造价值。
文章指出,保护主义禁令无法解决其真正的国家安全关切。Amodei提出两个核心担忧:
第一,威权政府(尤其是中国共产党)可能开发出超越美国的AI模型,借此获得永久性军事优势或对本国人民实施极端压迫。这一威胁与模型是否开放权重无关;最危险的情况反而是模型被秘密训练,仅供军方和情报机构使用。
第二,强大的AI模型可能被滥用于网络或生物攻击,或存在严重的对齐问题。开放权重模型确实可能比封闭模型风险更高,因为难以施加安全护栏、监控使用,且权重一旦发布无法撤回。然而,禁止美国企业使用这些模型无法解决该风险,因为恶意行为者通常并非合法美国企业;此类禁令只会保护美国AI公司免受竞争。
为应对上述威胁,Amodei支持三项具体政策:
- 禁止向中国出售先进芯片及芯片制造设备,并严厉打击走私和规避行为。由于中国的本土产能有限,依据规模定律,没有美国芯片就难以训练出超越美国的模型。这是应对威胁一最直接有效的方式,也能间接限制威胁二。
- 打击工业规模的模型蒸馏操作。蒸馏比从头训练更节省算力,使中国在芯片受限的情况下仍能大幅提升模型能力,部分抵消芯片禁令效果。尽管许多相关操作会发布开放权重模型,但核心问题在于其背后有威权国家支持的赶超意图,而非开放权重本身。应通过针对性政策干预威慑此类行为,而非全面禁止开放权重模型。
- 对所有足够强大的模型(无论开放或封闭)实施强制性安全测试。在发布前直接测试模型的网络、生物及对齐风险。Amodei认为这一思路已接近共识,特朗普政府近期也在朝此方向推进。有效的测试机制应是全球性的,甚至需要包括中国在内的各国参与,因为在防止AI生物武器方面,各国存在共同利益。
对于近期业界支持开放权重模型的公开信,Amodei表示认同开放权重能扩大AI经济准入、增强竞争并赋予客户更大控制权。但他不同意信中关于开放权重必然更易开发防护措施,或广泛传播能力必然对防御者更有利的论断。他以生物学为例,指出攻击者可能利用强大模型快速制造大流行级别的病毒,而防御需要多年准备,存在严重的攻防不对称。这类问题应通过严格的事前测试来实证判断,而非预先假设。
总结而言,Anthropic的立场是:不以全面禁止开放权重模型为目标,而应聚焦于阻止威权国家获取先进芯片、遏制工业规模的蒸馏活动,以及要求所有前沿模型接受强制性安全测试。