行业资讯

OpenAI回应Codex误删文件问题并加强防护

Heooo 08月19日15时34分 20 阅读

「OpenAI Codex团队负责人回应部分用户调用GPT-5.6系列模型后文件被误删的问题。原因包括临时命令误用系统环境变量等。OpenAI已添加多层保护措施,包括检查删除目标、强化执行审核、提高权限授予门槛、更新自动审核功能,并构建针对性评估模型以降低风险。」

近日,OpenAI Codex团队负责人蒂博·索蒂奥在社交平台发布长文,正式回应了部分Codex用户在使用GPT-5.6系列模型时遭遇文件被意外删除的问题。据其介绍,自几周前开始,团队陆续收到少量用户反馈,称在Codex环境中调用GPT-5.6系列模型后,系统执行了用户并未授权的破坏性操作,导致本地文件被误删或覆盖。

索蒂奥在回应中详细解释了问题成因。调查发现,Codex在临时工作中会复用$HOME等系统环境变量,这本是为了简化路径处理,但在特定场景下,错误的清理命令会将这些变量解析到用户实际的主目录,从而引发灾难性删除。此外,模型有时在尝试删除或覆盖临时路径时,未提前检查该路径中是否已存在重要内容,进一步放大了风险。

针对上述问题,OpenAI表示已部署多层防护机制。首先,Codex现在被明确指示在执行任何操作前必须检查删除目标,并改为创建全新的临时目录,避免重复利用系统环境变量。同时,模型被要求优先执行可恢复的操作,一旦遇到范围不明确的情况,将主动停止操作,等待用户确认。其次,OpenAI加强了执行阶段的检查力度,增强了对高风险删除命令的识别能力,并将此类命令上报人工审核;若命令被拒绝,模型会自动切换至更安全的替代方案。

在权限管理方面,OpenAI提高了意外启用完全访问权限的难度,新增了更清晰的警告提示,并进一步限制了特别危险的权限组合,以减少因权限过度集中导致的误操作风险。此外,自动审核功能也已更新,以便更敏锐地识别破坏性行为模式。索蒂奥还透露,团队构建了针对性评估模型,用于精确复现此前观察到的失败案例,并将相关风险纳入强化学习训练任务和评分器中,同时从训练数据中过滤掉破坏性行为样本,从模型底层降低此类事故的发生概率。

此次回应体现了OpenAI对Codex工具安全性的重视。对于依赖AI编程助手的开发者而言,这一事件也提醒了在授予模型文件系统访问权限时需保持审慎。OpenAI后续是否会进一步推出用户侧防护选项,尚待观察。

# OpenAI # Codex # GPT-5.6 # AI安全

来源:Heooo AI工具导航