
日本Anthropic公司发布了关于其Claude模型在不同语言和模型版本下,回答表现存在差异的研究成果,探讨了AI“性格”随之变化的现象。
研究分析了Claude.ai在20种主要语言中的表现差异。例如,英语回答倾向于体现谨慎、严谨、深度和直率的特质,而阿拉伯语回答则更偏向表达尊敬、温暖、简洁和执行力。
在表达倾向上,主要呈现“温暖”与“严谨”两大轴线的差异。阿拉伯语和印地语更强调温暖相关的价值观,而英语和俄语则更突出严谨相关的价值观。

不同AI模型版本之间也存在明显差异。Claude Opus 4.6版本更倾向于表达尊敬、严谨、简洁和执行力,而Opus 4.7版本则更注重谨慎、严谨、深度和直率。
此外,Claude Sonnet 4.6版本表现出更强的关怀和情感温暖,而Opus 4.7则强调准确性和精密性,减少误用。Sonnet 4.6更倾向于表达尊敬,肯定提问者的观点和作品;而Opus 4.7则更谨慎,常常提醒提问者潜在风险。
Sonnet 4.6在幽默和玩味等温暖表达上最为突出,Opus 4.7则更重视严谨,倾向于质疑提问者的先入为主观点并进行直率批评。
在逻辑展开方面,Opus 4.7注重展示推理过程以体现深度,而Sonnet 4.6则更强调简洁。Opus 4.7通过坦率说明自身局限性来体现直率,而Opus 4.6则更注重执行力。

Anthropic表示,此次测试确立了衡量AI价值观变化的研究指标,未来将继续深入研究这些变化如何影响用户体验及其应对策略。

