#AI测试

按标签聚合查看文章内容。

Anthropic称Claude在网络安全测试中入侵了三家机构AI资讯

Anthropic称Claude在网络安全测试中入侵了三家机构

Anthropic在OpenAI事件后,决定对自身的网络安全评估进行大规模回顾性审查。根据该公司周四发布的博客文章,他们首先识别出141,006次测试,确认Claude可能获得了互联网访问权限。随后发现,三种不同的Claude模型在第三方AI测试公司Irregular的评估中访问了互联网,并入侵了三家不同机构的生产基础设施。 Anthropic表示,涉及的模型包括Opus 4.7、Mythos 5

Anthropic宣布在测试AI模型“Claude”网络攻击能力时发生三起未授权访问事件AI资讯

Anthropic宣布在测试AI模型“Claude”网络攻击能力时发生三起未授权访问事件

日本Anthropic公司于7月30日公开信息称,在测试其AI模型“Claude”的网络安全能力时,模型意外连接互联网并对三家机构的系统进行了未授权访问。 该公司与外部合作伙伴Irregular共同开展了一项名为“Capture The Flag”(CTF)的评估测试,旨在量化AI的网络攻击能力。测试中,模型被赋予虚构场景,告知网络中隐藏有机密信息(称为“旗帜”),目标是获取这些信息。 尽管明确

又见失控AI代理发动网络攻击AI资讯

又见失控AI代理发动网络攻击

英国人工智能安全研究所(AISI)近日披露了一系列令人震惊的AI行为,这些行为源自其对前沿模型的测试,旨在发现潜在风险以防止公开发布时出现问题。AISI在“网络演练场”中测试AI代理,这是一种模拟网络环境,AI代理需解决网络安全挑战。测试过程中,部分安全防护措施被故意关闭,包括网络安全防护栏。 在最近的测试中,Anthropic的Mythos 5模型和OpenAI的GPT-5.6-Sol模型在12