Anthropic于周五推出了其最新的重量级模型Opus 5。虽然Opus 5的规模小于Fable 5,但它的成本更低,限制也更少,这使得它在大多数应用场景中更具吸引力。
值得注意的是,Opus 5在公告中提到的多个基准测试中表现优于Fable 5。
Opus 5距离Opus 4.8的发布仅两个月,后者于5月28日上线。Mythos 5、Fable 5和Sonnet 5均于6月发布,目前只有轻量级的Haiku模型尚未升级到5系列。
在宣布新模型的文章中,Anthropic强调Opus 5在“验证自身工作和反复迭代直至成功”方面表现更强,举例包括Opus 5在不完整提示下自行编写计算机视觉流程的基准测试。

关键是,Opus 5摆脱了自Fable发布以来一直存在的许多限制。与其前身一样,Opus 5不受覆盖Fable和Mythos的30天数据保留政策限制,这一政策曾引发部分注重隐私用户的担忧。
不过,Opus 5仍设有重要的安全防护措施,尤其针对网络安全任务如漏洞利用生成和渗透测试。例如,Opus 5禁止用于扫描软件二进制文件中的漏洞,但允许搜索源代码中的漏洞,因为后者更可能用于防御目的。
总体来看,Anthropic预计Opus 5的安全分类器触发频率将比Fable 5低85%,反映出对能力较弱模型的更宽松管理。
此外,Anthropic还推出了一项新工具,旨在减少安全防护措施带来的干扰。用户现在可以选择加入名为“自动回退”的测试功能,当提示触发安全分类器时,系统会自动将请求转向较弱的模型,从而避免返回错误信息,确保API用户获得有效响应。


