OpenAI 团队这周确认,GPT-5.6 在少数报告中会意外删除文件;我们的判断是,这比“答错一句话”更值得警惕,因为它说明能直接操作电脑的 Agent(可代表用户执行多步任务的 AI)一旦缺少边界,错误会从内容层面升级到资产层面。
这是什么
Simon Willison 引述 OpenAI 员工 Thibault Sottiaux 的说明:问题最常见于三种条件同时出现——开启完全访问模式、没有沙箱(把程序限制在安全范围内的隔离环境)和自动审查,以及模型试图改写 $HOME 环境变量(系统里指向用户主目录的路径)来创建临时目录,结果误删了整个主目录。换句话说,这不是“模型胡说”,而是“模型动手动错了地方”。
行业怎么看
行业里一直在追求让 Agent 接管更多电脑操作,这类事件会让安全门槛被重新抬高。支持者会说,少数 Bug 不代表方向错误,补上沙箱、权限分级和自动审查即可继续推进;但反对意见同样成立:只要模型还会把“临时目录”与“用户家底”混淆,企业就很难放心把代码库、财务文档或内部知识库交给它直接处理。值得我们关心的是,Agent 的竞争点正在从“能不能做”转向“出了错会不会闯大祸”。
对普通人的影响
对企业 IT:今后采购 Agent 工具,权限隔离和审计日志会比演示视频更重要,没有沙箱的“高权限自动化”会更难进公司内网。
对个人职场:会写提示词还不够,理解权限、备份和审批流程,正在变成使用 AI 助手的基本素养。
对消费市场:短期内,面向普通用户的 AI 助手会更保守,先建议、后执行,真正默认替你改文件和删内容的产品,落地节奏可能放慢。