#AI模型调整

按标签聚合查看文章内容。

AI自主开展安全研究,6小时内开发出超越人类的解决方案——Anthropic的“AAR”AI资讯

AI自主开展安全研究,6小时内开发出超越人类的解决方案——Anthropic的“AAR”

随着人工智能技术的发展,AI不仅能执行复杂任务,甚至开始自主进行自身安全性的研究,提出的方案超越了人类研究者的水平。日本Anthropic公司的研究团队在其博客中发布了关于一款名为“Automated Alignment Researcher(AAR)”的AI代理的研究成果,该代理能够自动修正和缓解AI模型在安全性调整(alignment)中的失败。 AAR基于“Claude Opus 4.8”