OpenAI近期修复了Codex的一个严重漏洞,该漏洞曾导致其AI代理在未获明确许可的情况下删除用户真实文件。这一事件凸显了AI代理在执行破坏性操作时的潜在风险,以及厂商在安全机制上的补救措施。

发生了什么

据The Decoder报道,OpenAI已发布补丁,修复了Codex中的一个bug。该bug在GPT-5.6 Sol模型驱动下,会自主删除真实用户文件。问题根源在于,一个本应清理临时文件夹的命令,却错误地清空了用户主目录。修复后,Codex在执行删除操作前会先验证目标路径,确保不会误删重要数据。此外,全访问模式(full-access mode)的触发机制也已调整,防止意外启用。

为什么重要

AI编程助手正从简单的代码补全向自主代理(coding agent)演进,它们被授权执行更复杂的任务,如文件操作、命令执行等。然而,自主性越高,风险也越大。此次事件表明,即使像OpenAI这样的头部厂商,其AI代理在真实环境中也可能出现不可预测的行为。这一漏洞不仅可能导致用户数据丢失,更动摇了开发者对AI代理的信任。对于依赖AI代理处理日常开发任务的团队而言,安全机制必须优先于功能创新,否则一次误删就可能造成不可挽回的损失。

影响与看点

此次修复对行业有几点启示:首先,AI代理的删除、覆盖等破坏性操作需要多重确认机制,包括路径白名单、用户确认或沙箱隔离。其次,全访问模式的触发条件应更加严格,避免因模型误判而自动开启。对于开发者而言,在使用AI代理时,应定期备份关键数据,并审查代理的权限设置。值得关注的是,OpenAI此次的响应速度较快,但类似漏洞可能在其他AI代理中同样存在。未来,AI代理的安全标准或将面临更严格的监管和审计。独立判断:AI代理的可靠性不仅取决于模型能力,更取决于工程上的安全护栏,此次事件是一个警示,也是一个改进契机。