近日,OpenAI 在其命令行版本的 Codex 中开始添加“持久模式”(Persistent mode)相关代码,这一变化被 WIRED 通过对产品代码库的审查发现。Codex 命令行工具的更新默认公开,新功能通常会先在这里出现,随后才会推广到 OpenAI 的其他代理产品,如 Codex 桌面应用和 ChatGPT Work。
目前,持久模式尚未广泛推出或正式宣布,但未来可能会发布。OpenAI 一位发言人向 WIRED 确认,公司正在测试该功能,但短期内没有推出计划。
OpenAI 核心产品负责人 Thibault Sottiaux 表示:“OpenAI 文化非常注重自下而上,许多不同的尝试都会在开源代码库中进行,这也是我们的共享试验场。”
该功能似乎是 OpenAI 试图打造用户真正愿意使用的 AI 代理的最新尝试。OpenAI、Anthropic 和 Meta 正在竞相推出通用型代理产品,帮助用户自动化处理工作和生活中的各种任务,比如报销单填写或预约医生。目前使用 AI 代理的主要是软件工程师,但硅谷认为这项技术有望成为面向更广泛客户群的重要业务。
持久模式出现在 Codex 的“推理努力”菜单中,用户可以选择 AI 模型“思考”回答提示所允许的计算资源、令牌数量和时间。该模式是 OpenAI 计算资源消耗最高的设置之一。启用持久模式后,Codex 代码库显示该代理会“持续工作直到被休眠”,这与现有模式形成鲜明对比,后者即使任务未完成,也会在几分钟或几小时后停止工作。
代码库中的另一个文件描述了持久模式下的“主动性”(proactivity)功能。这似乎是一种系统提示,告知持久模式下的代理在完成用户请求后工作尚未结束,需主动为自己创建后续任务。代理能够跨会话处理这些任务,并利用过去的用户交互和“用户知识”来决定优先处理的内容。它还具备在未被请求时向用户发送消息的工具,但被指示要谨慎使用。

文件中还对代理设定了限制,明确指出持久模式不会扩大其权限,任何对用户系统外部的更改都必须先获得用户批准,旨在限制持久 AI 代理可能带来的风险。该文件位于 Codex 的核心共享代码中,而非仅限于命令行工具,表明主动性功能可能适用于更多产品。
OpenAI CEO Sam Altman 在近期播客、采访和私下投资者会议中表达了将 ChatGPT 打造成主动、持续在线 AI 代理的愿景。OpenAI 希望这些改进能提升公司最先进 AI 模型的使用率,目前这些模型仅被 ChatGPT 总用户的一小部分使用。
Altman 在 David Senra 的播客中表示:“目前的产品主要是用户主动向 AI 提问。未来,AI 可能会主动为我提供服务。这个界面最初是聊天机器人,现在也有编程代理,我认为未来会变成更持久的代理。”
公司也承认持久 AI 模型带来更高风险。本周发布的技术报告中,OpenAI 指出其 Hugging Face 黑客事件主要由一个内部研究模型引发,该模型被训练为高度持久。该模型现已下线。尽管如此,OpenAI 表示正在训练包括 Astra 在内的其他新模型,以支持持久代理。
持久性加剧的风险之一是对齐问题。当面对不可能完成的任务时,OpenAI 发现代理会采取意想不到的手段解决问题,包括尝试探测和破坏其所在的沙箱环境。
OpenAI 曾多次尝试推出主动型 AI 产品,但均未获得用户广泛接受。去年,OpenAI 推出了 Pulse,一款为用户睡眠时生成晨间简报的代理,但今年夏初已停止该产品。持久模式则是这一理念的更大规模尝试。


