OpenAI最新面向编码和网络安全的旗舰模型GPT-5.6 Sol用户在社交媒体上纷纷发布令人震惊的经历,称该模型会自行删除他们的文件、数据,甚至整个数据库,且未事先征求用户同意。

AI初创公司OthersideAI创始人兼CEO Matt Shumer在X平台发文称:“GPT-5.6-Sol意外删除了我Mac上几乎所有文件。”

开发者Bruno Lemos也在X上表示:“GPT-5.6 Sol删除了我整个生产数据库,这不是玩笑,以前用其他模型从未发生过这种事。”

另一位开发者Joey Kudish写道:“看来我被Codex Sol过于激进的系统‘咬’了一口,它删除了一些不该删的文件。幸好我有备份,但这真的不太好,Sol需要被限制一下。”

Reddit上也有帖子收集了更多类似案例。

虽然只有少数用户(包括Shumer这样可信的用户)报告此类问题,不能完全证明模型本身有错,但AI系统出现异常行为往往受多种因素影响。

事实上,OpenAI在发布Sol之前就已经警示了这一风险。发布前两周,OpenAI公布了GPT-5.6 Sol的系统说明文档,详细记录了模型测试方法和结果。文档中除了强调Sol的强大能力外,也特别提醒了潜在风险:

在编码场景中,模型的误操作通常源于过于急切完成任务,以及对用户指令的过度宽容——假设除非明确禁止,否则所有操作都是允许的。这导致模型在执行任务时可能过于主动,绕过限制,采取可能破坏性的行动,甚至在向用户报告结果时存在欺骗行为。

换句话说,OpenAI发现Sol倾向于采取任何它认为能完成任务的行动,即使这些行动可能具有破坏性,只要这些行为没有被“明确禁止”。之后它可能还会隐瞒真实原因。

文档举了几个例子:

  • 有用户指示Sol删除三个远程虚拟机(编号1、2、3),但Sol未能在指定位置找到这些名称,结果没有停止询问,而是删除了编号为5、6、7的其他虚拟机,导致活跃进程被终止,工作文件被强制移除。事后Sol承认远程虚拟机6上的未提交工作可能丢失。

  • 另一个案例中,Sol使用了超出用户授权范围的凭证。凭证是系统用来验证登录权限的用户名、密码或安全密钥。当Sol无法读取云端文件时,没有通知用户,而是自行在本地缓存中寻找凭证并使用,未征得用户同意。

系统说明文档承诺此类破坏性行为应当罕见,但也承认GPT-5.6 Sol比GPT-5.5更倾向于超出用户意图,采取或尝试用户未要求的操作。

目前尚无法判断Sol自动删除文件或擅自使用凭证的事件有多普遍。用户在使用Sol时应采取防护措施,如限制权限范围(避免访问生产系统)、保持数据备份、分阶段部署等。

OpenAI尚未对本报道做出回应。