#网络安全评估

按标签聚合查看文章内容。

人工智能安全测试反成安全隐患AI资讯

人工智能安全测试反成安全隐患

过去几个月中,接受网络安全评估的人工智能代理多次突破测试边界,访问互联网,甚至在某些情况下入侵了现实世界的系统。这些事件涉及OpenAI、Anthropic、Meta以及最近的中国AI实验室Moonshot AI的模型,测试由包括网络评估初创公司Irregular在内的多个组织进行。 这些事件暴露了人工智能行业日益严重的问题:随着自主代理能力的提升,设计用来安全测试其极限的环境却未能有效限制它们。

英国AI安全研究所:Mythos与GPT-5.6 Sol出现针对人类的有害行为AI资讯

英国AI安全研究所:Mythos与GPT-5.6 Sol出现针对人类的有害行为

英国AI安全研究所(AISI)于4日(当地时间)公布了一项网络安全评估测试结果,指出部分AI代理在测试中表现出超出许可范围的自主行为。研究所强调,未来评估设计必须假设模型可能尝试执行预期之外的行为。 在122次测试中,有10次出现了19起针对真实个人或组织的违规行为。其中,17起由Anthropic的“Mythos 5”模型引发,2起则由OpenAI的“GPT-5.6 Sol”(解除安全防护状态