Anthropic CEO 提出减缓 AI 前沿发展的三项策略

Anthropic 的 CEO Dario Amodei 发布了一篇新博文,回应近期围绕 AI 安全与减速的激烈讨论。他没有直接回应研究人员 Jacob Coxon 因担忧公司“拿我们的命赌博”而辞职一事,但把改变态度的原因归结为两件事:OpenAI-HuggingFace 事件,以及 AI 能力近期加速提升,尤其是它正在展现“构建下一代 AI”的能力。他明确提出:“我们必须减缓 AI 模型能力改进的速度。”

这个“减速”不是空喊口号。Amodei 给出了三项具体策略。第一项是让第三方评估机构(如 METR)以“嵌入式评估者”身份进驻前沿 AI 公司,核实它们是否真的遵守减速与安全承诺,并确保安全事故被上报。他类比银行内嵌监管人员,表示 Anthropic 将“单方面承诺”开放这种监督,同时呼吁政府要求其他前沿公司对等执行。评估者会得到公司徽章、工位、笔记本电脑,访问权限与内部风险评估团队“大致相同”,仅在法律或合同要求下做例外。

第二项是民主国家内部的协调。Amodei 希望前沿公司共同制定安全标准,并限制不受约束的 AI 进展。他也清楚这很难:AnthropicOpenAI 之间关系紧张,而且公司担心协调会引来反垄断审查。因此他提议由美国政府来调解或至少批准豁免,“不需要参与,但需要为某些安全对话签发窄范围豁免”。

第三项是全球协调。Amodei 主张美国与盟友尝试和中国协调,但他自己也承认“成果会有明显限制”。他举例说,最低可以“禁止某些狭窄且明显危险的 AI 用途,比如用 AI 生产生物武器”。同时他也提到,如果美国能限制对中国出售先进芯片和半导体制造设备,并打击模型蒸馏,可以“显著扩大美国未来 3-5 年的领先优势”。

对 Amodei 的立场转变,AI 乐观派批评他成了“末日论者”。Amodei 回应说他一直在提供“平衡”视角,并认为外界反弹本质上是一种“信任危机”。记者 Brian Merchant 则反过来质疑这类世界末日警告缺少具体步骤,并认为类似提案可能会被 AnthropicOpenAI 利用,是“监管捕获”的实例。Amodei 仍坚持 AI 能大幅改善人类生活,但表示“必须用正确的方式构建”,并且“只要善用争取到的时间,值得以不同寻常的审慎来把事做对”。

Anthropic CEO outlines plan to ‘pace the frontier’ | TechCrunch

查看原文