
Anthropic 对开源权重模型的立场声明

Anthropic CEO Dario Amodei 发表了一份关于开源权重模型的明确立场声明,澄清了该公司并不支持全面禁止此类模型。他的论述基于两个核心国家安全担忧:一是威权国家(如中国)利用AI获得军事或监控优势;二是强大模型可能被用于网络或生物攻击。Amodei 认为,禁止美国企业使用中国的开源模型无法解决这两个问题,因为最危险的模型可能被秘密训练并直接交给军队,而真正的恶意行为者也并非合法企业。
他主张将资源集中在三项更有效的措施上:第一,禁止向中国出售先进芯片及制造设备,并打击走私行为。由于中国本土产能有限,这一措施能直接遏制其训练超过美国的前沿模型。第二,打击工业规模的模型蒸馏行为,因为蒸馏可以绕过芯片禁令,让中国在较少的算力下快速追赶美国前沿水平。第三,对所有足够强大的模型(无论开源还是闭源)实施强制性安全测试,特别是针对网络、生物和alignment风险。他特别指出,这种测试必须是全球性的,并认为中国也有可能参与针对AI生物武器的有限合作。
Amodei 对支持开源模型的公开信部分内容表示认同,例如开源模型能扩大AI经济参与度、在某些场景下增强竞争并给用户更多控制权。但他不同意信中关于开源模型必然更易开发安全措施,或广泛的能力开放必然更有利于防御方的观点,并以生物领域的攻击-防御不对称性作为反例。他的总结立场清晰:Anthropic 不主张全面禁止开源权重模型;重点应是控制芯片流向、打击工业蒸馏,并对所有足够强大的模型进行强制安全测试。


