Anthropic发布Opus 5模型

上周五,Anthropic发布了最新重模型Opus 5。相比此前推出的Fable 5,Opus 5体量更小、API调用成本更低,且限制更少——在许多使用场景下会更具优势。Anthropic公布的基准测试表明,Opus 5在多项指标上实际优于Fable 5。

Opus 5距上一版Opus 4.8仅隔两个月(4.8于5月28日上线)。Anthropic旗下其余模型(Mythos 5、Fable 5、Sonnet 5)均已在6月完成5系列升级,目前仅剩轻量级Haiku尚未更新。

Anthropic强调Opus 5“在验证自身工作、迭代直至成功方面显著增强”。例如,在完形填充测试中,Opus 5能从不完整的指令出发,自主编写一套完整的计算机视觉管线。

关键区别在于,Opus 5免受很多拖累Fable的限制。它像前代Opus一样,不适用针对Fable和Mythos的30天数据保留政策——该政策曾引发部分重视隐私的用户担忧。当然,Opus仍配备有实质性的安全措施,尤其在利用生成、渗透测试等网络安全任务方面。例如,Opus 5被禁止用于扫描软件二进制文件中的漏洞,但允许搜索源码中的漏洞,因为后者更可能用于防御性目的。总体而言,Anthropic预计这些分类器的触发频率在Opus 5上将比Fable 5低85%。

Anthropic还推出了一项降低干扰的新工具。用户可自愿开启名为“Automatic Fallbacks”的beta功能:当提示词触发安全分类器时,系统会自动将请求路由到能力较弱的模型,从而让API用户获得有效回复而非错误信息。

Anthropic launches Opus 5 | TechCrunch

查看原文