Claude Fable 5.1

日本Anthropic公司今日推出了新一代AI模型“Claude Fable 5.1”,其科学研究评分是之前“Fable 5”的两倍。然而,如何防止通过非法蒸馏技术从高级AI模型中提取知识并应用于其他模型,成为亟需解决的问题。为此,Anthropic于美国时间9月1日宣布,针对最新模型Claude Fable 5.1,调整了消息API中思考块的处理方式,以防止蒸馏攻击导致模型被非法训练。

此前,在多轮对话中,用户可以发送包含上一次思考块的完整上下文。但根据新规范,如果系统提示或消息等思考块之前的上下文被修改,API将返回错误,阻止继续处理。

Anthropic指出,修改对话历史被用于非法提取高级模型的思考能力,并未经授权训练其他模型,这种行为曾通过数千个假账号在产业规模上进行。虽然Claude模型对思考块进行了加密,但上下文一旦被篡改,推理内容仍可能被解密输出。

考虑到上下文修改在某些合法场景下仍有需求,公司为开发者提供了“非严格”模式,允许在排除过去思考块的情况下继续对话,满足特定应用需求。

此次API规格调整将从2026年8月31日以后创建的新账户开始逐步实施,现有账户不受影响。同时,Claude.ai、Claude Desktop、Claude Code等面向终端用户的应用及第三方产品的使用也不会受到影响。