Anthropic 向 Public First Action 追加 2000 万美元捐款用于 AI 安全政策倡导

Anthropic 宣布向非营利组织 Public First Action 追加 2000 万美元捐款,使其对该组织的总资助额达到 4000 万美元。Public First Action 是一个跨党派组织,专注于向公众进行 AI 科普,并与共和党、民主党和独立派人士合作,推动制定“合理的 AI 安全防护措施”。Anthropic 明确表示,这两笔捐款仅用于支持该组织的公共教育和政策使命,不得用于影响任何联邦、州或地方公职的选举。

Anthropic 在 2026 年 2 月的第一笔捐款,旨在推动维护有意义的安全护栏、维持美国在 AI 领域的领导地位,并要求最强大的 AI 模型开发者提高透明度。Anthropic 认为,几个月来这些政策主张的紧迫性只增不减。

关于“为什么是现在”,Anthropic 给出了具体的技术背景:今年早些时候,其模型 Claude Mythos Preview 发现了数千个高严重性软件漏洞,包括每个主流操作系统和浏览器中的漏洞。Anthropic 通过 Project Glasswing 将该模型有限地提供给网络防御者,让可信的实体能在漏洞被利用前找到并修复它们。而在错误的人手中,这类模型可能威胁国家依赖的关键系统,从医院到电网。

更强大的模型将带来压缩药物发现、开发前所未有可治疾病的疗法、加速科学实现十年内完成一个世纪的进步、延长人类寿命以及推动经济增长等益处——但 Anthropic 强调,必须先确保防范好风险,才能实现这些好处。政府需要时间来建设既能获取收益又能管控风险的能力,因此现在就必须开始行动。

在政策层面,Anthropic 重申其立场:前沿 AI 公司应对模型能力和风险管理保持透明。Anthropic 支持了几个州新通过的要求 AI 开发者提高透明度的法律。但对于能力飞速发展的最强大模型,仅靠透明度是不够的。Anthropic 提出了其 Advanced AI Framework,这是目前来自任何前沿实验室或政策制定者“最强有力的政策提案”。其核心包括:政府应能核实公司的安全声明、通过民事处罚强制执行安全实践,并最终拥有延缓或阻止部署存在严重灾难性风险模型的权力。前沿 AI 开发者需测试存在灾难性风险的模型、向公众公开测试结果、提交独立评估,并维护稳健的安全计划。

Anthropic 还在其报告《2028:全球 AI 领导力的两种情景》中指出,随着 AI 发展加速,AI 的国家安全赌注正在加大。美国及其民主盟友目前有优势,但这一领先地位是脆弱的。为确保美国持续的 AI 领导力,Anthropic 支持收紧对先进芯片和半导体制造设备的出口管制,并遏制非法模型访问和蒸馏攻击,以防止民主国家的最优技术被用于推进威权国家的 AI。

Anthropic 表示,这些政策框架只是一个起点,对 Public First Action 的捐款是提升这一紧迫政策辩论关注度的一种方式。

Donating another $20 million to Public First Action

查看原文