OpenAI Astra

2026年8月7日(美国时间),OpenAI宣布对其次世代模型“Astra”的开发进行部分限制。尽管该模型在内部评估中展现出显著进步,但其具备的网络攻击能力可能达到公司安全指南中最高级别“Critical(关键)”,因此决定暂停除隔离测试环境外的所有内部使用。

“Astra”是OpenAI下一代主要模型的代号。8月1日的内部测试显示,该模型在数学能力上表现卓越,成功解决了十多年来未被攻克的数学难题,凸显了其潜力及先进AI模型广泛应用的重要性。

然而,鉴于近期发现的网络安全风险,OpenAI优先考虑安全措施,限制了“Astra”的开发和内部使用。自2023年12月起,OpenAI制定了“准备框架(Preparedness Framework)”,用于评估AI模型能力并确定应对策略。当前最高级别模型“GPT-5.6 Sol”的网络能力被评为“High(高)”,而“Astra”可能已达到最高“Critical”级别。

基于此框架,OpenAI决定仅允许“Astra”在隔离测试环境等严格安全条件下使用,暂停其他所有内部开发和应用。同时,公司将与政府机构及AI安全组织合作,持续验证模型功能并探讨额外安全措施的实施。

值得一提的是,7月发生的针对Hugging Face的入侵事件并未涉及“Astra”。

OpenAI强调,具备高级网络功能的模型应帮助防御方先于攻击者发现并修补漏洞。虽然尚未公布“Astra”的公开发布时间,OpenAI首席执行官萨姆·奥特曼在社交平台X上表示:“Astra是一个强大的模型,我们希望能广泛发布。将强大模型仅限于少数人使用并非良策。考虑到其网络能力,我们需要更多时间确保安全,但希望不会太久。”