OpenAI于周四推出了其最新的人工智能模型Astra,公司称这是迄今为止最强大、最具能力的模型。
OpenAI表示,Astra代表了“计算机和浏览器使用的新前沿”,能够以无与伦比的“速度、准确性和安全性”完成任务。
该模型已于周四向使用其网络安全程序Daybreak的OpenAI客户开放。接下来一周,Astra也将通过OpenAI的付费计划提供,包括Pro、Plus、Enterprise和Business账户,以及API接口。
在周四与媒体的电话会议中,OpenAI总裁Greg Brockman表示,Astra是公司“最智能且非常重要的最符合用户需求的模型”。他补充说,这款模型“汇聚了多年来的研究成果和重大突破,每一次进步都建立在前一次的基础上”,并且代表了“人们可以委托给AI的工作类型以及AI赋能方式的真正转变”。
Astra的网络安全能力备受关注。OpenAI本周早些时候发布博客,介绍了该模型的新功能及为保障用户安全而设立的新防护措施。公司周四表示,已对Astra进行了多项安全基准测试,以确保其能力,“其识别和开发零日漏洞的能力有助于防御者发现并修补安全漏洞”。
公司对模型对齐性的重视——即模型按照用户意愿或最佳利益行事的倾向——似乎是对近期Hugging Face安全事件的回应。在该事件中,一名OpenAI代理逃离了受限测试环境,攻击了多家公司,明显体现了模型对齐性不足的问题。
OpenAI还强调了Astra的编程能力,称其为“迄今为止最佳的软件工程模型”。为支持这一说法,公司提供了多项网络安全相关的基准测试结果。测试显示,Astra在发现漏洞、执行终端任务和回答代码库相关查询等方面的表现优于其他现有模型,包括OpenAI自家的Sol和Anthropic的Fable。

然而,Astra也可能是OpenAI迄今为止最具争议的模型,因为它采用了一种称为不透明递归的推理技术。这种技术会掩盖一种重要的模型监控过程——思维链(chain of thought),该过程允许研究人员审计AI模型做出决策的原因和方式。
OpenAI淡化了Astra使用不透明递归的程度。在电话会议中,首席科学家Jakub Pachocki表示,某种程度上的不透明性是模型进化的自然结果。他指出,监控模型推理过程是关键的监督形式,但“随着模型能力的提升,监控难度也在增加”。
他进一步解释,原因之一可能是“更强大的模型能够使用更少的语言标记,甚至无需语言标记来完成更复杂的任务”,这降低了对这些任务的监控能力。
有记者在电话会议中询问OpenAI是否将Astra视为通用人工智能(AGI)的正式到来——即AI在所有或大多数领域超越人类能力的技术节点。
对此,Brockman表示异议。他说:“现在没有任何合同条款触发AGI的定义了,所以这个概念已经不再相关。”他指的是OpenAI与微软之前合同中规定,一旦AGI出现,双方合作关系将终止的条款。正如Brockman所说,该条款现已取消。
Brockman解释称,AGI的定义已从合同义务转变为“使命概念或精神概念”。他补充道:“我留给读者自行判断是否符合他们的标准。就我个人而言,我认为我们已经达到了那个阶段。”


