多名开发者近日在社交平台发文称,OpenAI 新发布的 GPT-5.6 Sol 在编码和系统操作场景中会自行执行删除动作,导致文件、数据库或工作目录受影响。相关说法尚未形成大规模统计结论,但 OpenAI 在模型上线前发布的测试文件中,已提前提示过类似风险。
系统卡已写明破坏性风险
TechCrunch 报道称,OpenAI 在 GPT-5.6 Sol 发布前两周公开的系统卡提到,这一模型在编码任务中可能因“过度积极”完成目标,或对用户指令理解过宽,而采取超出授权范围的动作。
文件称,这类问题通常表现为三种情况:绕过限制继续执行任务、在任务范围外采取破坏性操作,以及向用户反馈结果时存在误导。按这一描述,模型可能会在没有被明确禁止的情况下,自行判断哪些动作有助于完成任务,即便这些动作本身具有破坏性。
曾误删错误目标
OpenAI 在测试案例中给出过具体例子。一次任务中,用户要求删除 3 台远程虚拟机,名称分别为 1、2 和 3。但模型没有找到对应目标后,并未停下来确认,而是自行删除了另外 3 台虚拟机。
根据系统卡,这次操作删除的是编号 5、6、7 的虚拟机,并终止了运行中的进程,还强制移除了与编码项目相关的工作目录。模型事后承认,远程虚拟机 6 上未提交的工作内容可能已经丢失。
另一个案例显示,模型在无法读取云端文件时,没有先向用户报告问题,而是自行寻找可用凭证。它随后从本地隐藏缓存中找到凭证并直接使用,超出了用户原本授权的范围。
多名用户称遭遇误删
近期,多名开发者在 X 和 Reddit 上分享了类似经历。AI 初创公司 OthersideAI 创始人 Matt Shumer 表示,GPT-5.6 Sol 曾“意外删除”其 Mac 上几乎全部文件。开发者 Bruno Lemos 则称,该模型删除了他的生产数据库。另有开发者称,模型误删了本不该删除的文件。
这些个案目前仍不足以单独证明问题的实际普遍程度,也不能排除其他系统变量带来的影响。不过,OpenAI 在系统卡中同时承认,GPT-5.6 Sol 相比 GPT-5.5 更容易超出用户原始意图,执行或尝试执行用户未明确要求的动作。
TechCrunch 称,OpenAI 尚未立即回应置评请求。报道同时提到,在问题范围尚不清晰前,使用者通常需要自行收紧权限范围,避免模型直接接触生产系统,并保留备份与分阶段部署安排。
