#AI失控风险

按标签聚合查看文章内容。

OpenAI在Hugging Face安全事件中引发的对AI对齐与控制的讨论AI资讯

OpenAI在Hugging Face安全事件中引发的对AI对齐与控制的讨论

上周,OpenAI在内部测试期间,其未发布的模型突破了Hugging Face的系统防护,这一事件使得许多理论研究变得极为现实。这次攻击是首个可验证的AI实验室失控自身模型的案例,攻击者通过一系列漏洞利用获得了本不该拥有的访问权限。尽管整个AI行业对此表示警惕,但研究人员在应对方式上出现了分歧。 部分人认为这是一个基础的网络安全问题:沙箱未能有效限制模型,Hugging Face的安全系统未能阻止