#人工智能 Codex 团队正在加强安全和删除逻辑,减少出现删除用户 $HOME 目录的问题。此前有开发者使用 Codex 执行任务时遇到命令转义问题,结果 Codex 直接删除 C 盘和 D 盘的大部分文件。现在 Codex 发布多项措施改进模型操作,包括在操作前检查删除目标、避免重用系统环境变量、识别到高风险命令时自动审查。完整改进:https://ourl.co/126328
10 天前 V2EX 网友使用 Codex 开放完全访问权限执行任务时,因遇到命令转义问题结果 Codex 不慎删除 C 盘和 D 盘的大量文件,得亏网友平时有备份所以还能通过备份数据恢复。当然也有其他开发者遇到类似问题导致文件被误删,现在 Codex 团队已经发布新版本并加强安全措施用来降低误删文件的发生概率。
Codex 在工作中有时候会创建临时文件夹并在用完后主动清理这些文件夹,在极少数情况下 GPT-5.6 会弄错清理操作,例如涉及重用系统环境变量 $HOME 来进行临时操作,这时候格式错误的清理命令有可能会指向实际的用户主目录,而不是最初创建的临时目录。
还有些情况是模型试图删除或覆盖临时文件时没有预先检查对应路径里是否存在其他文件,如果模型提前进行检查也可以降低或完全避免出现这种误删文件的情况。
1.现在明确指示 Codex 在操作前检查删除目标、创建全新的临时目录、避免重用系统环境变量、优先选择可以恢复的操作,在范围不明确时必须停止操作。
2.加强执行检查逻辑和机制,这些机制会在识别到高风险删除命令时将其升级审查 (由审查模型自动审批),如果命令被拒绝,模型将被引导采取更安全的做法来执行操作。
3.继续优化完全访问权限的开启,除非用户明确选择使用完全访问权限 (Full Access),否则 Codex 只会使用用户审批或自动审批模式,而且也难以出现被意外启用完全访问权限的情况。
4.OpenAI 还在云端更新 GPT-Auto-Review 审阅模型,该模型负责对常规模型发出的命令进行审阅,如果使用破坏性命令则会被审阅模型自动拦截,避免放行高危命令。
5.OpenAI 构建针对性的评估,这些评估会重放观察到的失败执行,同时通过强化学习任务和评分器从训练数据中过滤掉破坏性操作,模型在使用时可能会降低出现破坏性命令的概率。
Codex 技术经理蒂博建议用户升级到 Codex 最新版以获得更好的安全性、性能和其他改进,同时用户应当使用用户审批或自动审批模式,仅在完全可信且可以恢复的环境中才可以考虑使用完全访问模式。
当然如果还遇到其他极端情况也建议用户提交反馈,这也可以继续帮助 OpenAI 改进 Codex 并最终造福所有用户和开发者。






