美国政府暂停Anthropic发布Fable 5和Mythos 5

美国政府突然对Anthropic下达出口管制令,要求立即暂停所有外国公民(包括其内部的外籍员工)访问Fable 5和Mythos 5模型。这本质上是政府以国家安全为由,用一个极其含糊的“越狱”漏洞,对一个已上线运行、服务着数亿用户的商业模型实施了变相召回。核心矛盾在于:政府看到的是一个极度狭窄、非通用的越狱案例,其展示的能力甚至其他公开模型也具备,但政府认为这个发现足以引发国家级安全担忧。这让Anthropic陷入了两难——既不能公开质疑政府的判断,又必须在没有拿到任何书面技术细节的情况下,勒令全球客户立即断联,整个事件的核心就是政府监管尺度和技术事实之间的激烈碰撞

Anthropic的应对策略很直白:以合规为前提,先执行、再澄清,同时坚决捍卫自己的技术主张。他们公开了自己在Fable 5设计之初就坚持的“纵深防御”战略——不追求不存在完美防护,而是让越狱变得要么成本极高、要么攻击面极窄,配合30天数据留存来快速追踪攻击。公司坚定认为,这次被政府拿来做例子的“越狱”根本不算真正的威胁,甚至不如其他公司模型日常使用的代码审计能力来的强大。他们只是引用了对方的演示视频,没有提供任何可复现的技术细节。整件事的尴尬在于:如果所有前沿模型都要因为“某个狭窄漏洞被发现了”就马上撤市,那整个行业的新模型发布将彻底停摆。

Anthropic用这次事件给整个AI行业打了一个非常真实的预防针:技术安全不是纯粹的技术问题,最终的决策权掌握在行政权力手中,而行政审查的标准很可能远低于技术团队自己定的风险阈值。这对所有前沿模型厂商的启示非常明确——在模型上线之前,必须与监管侧提前建立可量化的安全评估标准,而不是等发布之后再被一封没有具体细节的行政指令打乱节奏。否则,类似“因发现一个微小的非通用越狱就全面下架”的极端事件,会反复上演。更关键的是,Anthropic强调“我们还没收到任何造成实质性危害的证据”,这个表态本身已经表明,未来模型发布前的红队测试和合规博弈,将不只在技术圈内进行,还要直接进入法院和国会。

Statement on the US government directive to suspend access to Fable 5 and Mythos 5

查看原文