8月19日消息,针对近期OpenAI Codex在使用GPT-5.6系列模型时误删部分用户文件的事件,OpenAI Codex团队负责人蒂博·索蒂奥今日在X平台发布长文进行回应,并宣布已上线多层保护措施。

索蒂奥表示,几周前开始收到少量用户反馈,称Codex执行了未授权的破坏性操作。经排查发现,本应清理临时文件的命令误删了用户文件。具体原因在于,Codex在临时工作中重用了 $HOME 等系统环境变量,导致错误的清理命令直接指向用户主目录;且模型在尝试删除或覆盖临时路径时,未检查路径中已存在的内容。
为防止此类问题复发,OpenAI已部署多层防护:首先,明确指示模型在执行前检查删除目标、创建新临时目录、避免重用系统变量,并在范围不明确时停止操作;其次,增强对高风险删除命令的识别与拦截,若命令被拒,模型将采取更安全的方法;同时,提高了意外开启完全访问权限的难度,收紧了危险权限组合;最后,更新了自动审核功能,并构建了针对性评估模型以重现失败案例,同时从训练数据中过滤破坏性行为,添加了专门的强化学习任务。

微信扫一扫
支付宝扫一扫 