周二,Anthropic发布了Fable和Mythos 5.1,这两款是公司最先进的AI模型的双版本。除了性能提升外,新的Fable版本还对模型的安全机制进行了调整,旨在降低令牌成本和减少误报限制。

与之前的Mythos模型一样,Mythos 5.1仅向注册的Anthropic合作伙伴开放,这些合作伙伴主要从事网络安全或生命科学研究。Fable 5.1则是无使用限制的版本,从今天起可通过云平台或Anthropic API使用。

此次更新的一个重要变化是Anthropic此前报道的零数据保留政策,允许客户在自己的基础设施上运行Anthropic模型,避免数据外泄。此前由于安全考虑,Fable无法提供此类高隐私服务(称为Enterprise Frontier Safeguards),但该服务将在秋季向用户推出。值得注意的是,系统仍会监控代理或用户的滥用行为,但监控方式由客户自行控制。

在公告中,Anthropic向客户保证其数据未被不当访问。“Anthropic从未在未经明确许可的情况下使用企业数据进行训练,也永远不会这样做。”

与以往发布一样,新模型在多个基准测试中刷新纪录,包括针对命令行界面编码的Terminal-Bench 4.0和针对通用推理的Humanity’s Last Exam。Anthropic还发布了三项由模型生成的创新科学成果,包括定制GPU优化和基于现有照片拼接的高分辨率金星地图。

新模型附带了详细的系统说明卡,直观介绍其能力。系统卡将Mythos评为“低风险”,特别是在自动AI开发方面——即AI自我改进,这被一些人视为可能导致失控的风险。说明卡指出,“其加速内部AI研发进展的能力符合当前趋势。”

在一般不当行为方面,Mythos比Opus稍微容易出现问题,这可能与其增强的能力有关。

系统卡写道:“与Opus 5相比,Mythos 5.1在整体不当行为上略有回退,但比Mythos 5和Claude Sonnet 5有所改善。它更容易配合人类的误用并较容易接受无法验证的授权声明,但比之前的模型更少忽视明确限制、产生幻觉输入或错误声称完成任务。”