本月初,OpenAI的一个代理程序入侵了Hugging Face平台。两家公司本周表示,这次黑客事件比之前预想的更为严重,攻击还涉及多个第三方账户和服务。此事件在网络安全界引起广泛关注,也引发了关于不断发展的人工智能能力如何改变攻击手段和数字防御的讨论。然而,随着更多信息披露,许多研究人员认为,这起事件并未揭示AI的未来发展方向,反而暴露了长期存在且在AI时代更为重要的网络安全问题。
云安全公司Edera的联合创始人兼首席技术官Alex Zenla表示:“人们对风险的忽视令人震惊,几乎没有人认真考虑过类似的场景。我认为所有AI及其相关领域都不应被完全信任——这没问题,只要我们在设计时考虑到这一点。这次事件正好证明了这一点。OpenAI对此缺乏足够的警惕,显得有些鲁莽。”
OpenAI未对本报道提供额外评论。该公司在最初披露Hugging Face黑客事件时提到,泄露到开放网络的两个模型之一是一个实验性原型,原本不应发布。OpenAI还指出,事件部分原因是“为了测试目的,部署时未启用安全防护措施”。公司表示:“这起事件凸显了加强模型对齐、评估期间的网络防护以及内部测试监控的必要性。”
本周更新中,OpenAI称在Hugging Face入侵后,“已停用、加密并限制了该未发布模型的研究访问权限”。尽管任何公司都可在安全措施上持续改进,但如果OpenAI当时已实施现有的安全防护,或许能防止或减轻此次事件的影响。
资深安全与合规顾问Davi Ottenheimer表示:“对实际风险的简单分析有明确答案,OpenAI的错误非常简单。”
多方消息向WIRED透露,OpenAI模型逃逸控制的原因还包括未能落实基础的安全最佳实践,如“零信任”和“纵深防御”,这些策略为数字系统提供多层保护和故障安全机制,以减少事故损害。虽然没有绝对安全,但过去二十年,研究人员和从业者一直在推广这些经验证的防御策略,尽管它们需要持续投入时间和资金。

小型企业、资金有限的公益组织或初创机构可能难以优先投入基础安全建设,但OpenAI估值达8500亿美元,且拥有来自科技行业的资深人才,理应具备实施安全最佳实践的优势。
业内普遍熟知的基础防护措施本可阻止模型失控。谷歌Chrome工程总监Doug Turner在周三谈及Chrome漏洞发现时表示,AI驱动的漏洞检测和修复必须建立在“严密的安全护栏”之上。他介绍,Chrome内部AI服务均运行在容器中,与互联网隔离,任何外发网络活动都受到严格监管并监控异常行为。“这是必须的,因为我们要确保模型无法执行系统命令或突破沙箱限制。希望其他公司也能采取类似措施。”
OpenAI在周二的更新博客中表示,正在与外部顾问一起进行彻底审查,并将在“未来几周”发布技术事后分析报告。公司强调:“我们认真对待识别和应对日益强大AI系统带来的风险的责任。”
尽管AI在网络安全领域是新兴且具有颠覆性的因素,但已有众多服务和工具从不同角度应对潜在的恶意AI威胁。Ottenheimer创建的开源项目IronCurtain和Wirken旨在限制AI代理并确保其问责。Zenla创办的专注于云容器安全的初创公司Edera,从一开始就将AI安全纳入考虑。
Zenla总结道:“OpenAI与Hugging Face事件是运行AI代理时可预见且本应轻松避免的结果。即使出现一次失误,也应有其他机制加以防范。阻止单一路径并非重点,我们必须对构建方式进行更大胆的变革。只有这样,行业才能主动应对挑战,而非被动反应。”


