
Anthropic 发布 Opus 5.5:价格更低、性能达 Fable 水平

Anthropic 于周二发布了新模型 Opus 5.5,公司称其在编码和知识工作类任务上刷新了当前最优水平。值得注意的是,Anthropic 表示,Opus 5.5 在多个基准测试中超过了更大的 Fable 模型,并且完成了一些 Fable 未能完成的非正式任务。
价格方面,Opus 5.5 比上一代明显更便宜。输出 token 定价为每百万个 20 美元,而上一代是 25 美元;其他计费指标也有类似幅度的下调。同时,新模型运行速度更快,整体所需的推理计算量更低。
Opus 5.5 在输出风格上也做了明显调整:它更少使用行话,并且更倾向于把重要信息放在消息开头。这次发布距离 Opus 5 上线(7 月 24 日)仅两个月。Anthropic 还透露,Sonnet 5.5 和 Haiku 5.5 会在“未来几周”内发布,并有类似的性能提升。
安全方面,Anthropic 称 Opus 5.5 在生物学和网络安全能力上与 Mythos 相当,因此它受到与 Fable 模型相同的安全限制。这些限制包括:不鼓励模型被用于发现已编译程序中的漏洞、开发可识别的生物武器等。Opus 5.5 是 CEO Dario Amodei 公开支持“调节前沿推进节奏”(即刻意放慢能力提升速度,以便对齐工作跟上)后的首个模型。Amodei 本月初写道,他确信要充分应对风险需要更多审慎,不只是投资风险预防,还要调整能力进步的速度。
Opus 5.5 的安全训练方式与此前大致相同,包括对齐测试以及 METR、Frontier Design 等外部机构的发布前评估。但 Anthropic 强调,针对未来模型的更高级训练和评估系统已在准备中,包括改进的安全与监控系统。Anthropic 在博文中表示,随着 AI 能力变强,公共政策应在保障系统安全方面发挥更大作用,而这类能力的构建需要时间,他们已经开始搭建相应基础设施,并预计很快分享更多细节。


