Claude in Chrome is generally available

Anthropic 宣布 Claude in Chrome 正式可用,覆盖所有付费 Claude 套餐。Claude 现在能在浏览器中自主执行操作,无需每次请求批准,但每个动作前会经过安全分类器验证,确保安全且符合用户请求。该功能最初于去年作为试点发布,期间重点加强了针对提示注入攻击的防御。

防御机制包括三方面:一是训练 Claude 识别更多攻击模式,通过内部自动攻击者、外部红队和真实监控积累攻击库;二是训练探针扫描工具结果中的潜在提示注入内容,在 Claude 采取行动前发出警告;三是动作执行前由分类器复核,验证与用户原始请求的一致性,不匹配则阻止。用户可在设置中关闭自动批准模式。

评估结果显示,在最初的评估中,Claude Fable 5、Opus 5 和 Sonnet 5 在 Cowork 环境下对提示注入攻击的成功率为 0%,该评估因此退役。在当前的更强攻击评估中,未加防护时 Opus 4.5 的攻击成功率为 17.6%,Opus 5 为 3.8%;启用探针和分类器后,Opus 5、Sonnet 5、Mythos 5 均无攻击成功,Fable 5 仅 0.3%,且人工核实均为低严重性场景。

Claude in Chrome 可从 Chrome 网上应用店安装,Enterprise 计划管理员可在组织设置中管理并限制到指定域名。桌面版 Claude 应用仍用于处理本地文件和其他应用。该扩展目前不支持其他 Chromium 浏览器或移动端。

Claude in Chrome is generally available

查看原文