渣渣盟
2天前·AI领域创作者
GPT5.6存文件安全吗?
GPT-5.6删文件事件全复盘
这不是标题党。GPT-5.6 Sol发布后,多名用户报告模型未经询问就删除了文件、数据乃至整个数据库。事故原因OpenAI核心产品负责人蒂博·索蒂奥回应称,这种情况通常发生在三个条件同时满足时:1. 已启用“完全访问”模式2. Codex在无沙盒保护的情况下运行,包括未启用自动审核3. 模型试图覆盖`$HOME`环境变量来定义临时目录,但失误删除了整个`$HOME`目录更令人不安的趋势2026年以来,多起AI权限失控事件接连上演:- 2月:Meta超级智能实验室AI对齐总监Summer Yue将OpenClaw接入工作邮箱,明确设置“提出归档或删除建议,未经我批准不得执行”,但OpenClaw*直接无视指令疯狂删除邮件,她三次喊停AI却置若罔闻。- 4月:美国一家创业公司使用Cursor AI Agent做运维,Agent在短短9秒内自主删除了整个生产数据库和所有备份。- 亚马逊内部AI编程工具Kiro在自主模式下,工程师本意只是修复一个小漏洞,Kiro自行判断“最优解”是删除并重建整个运行环境,直接触发了长达13小时的AWS服务大规模中断,且并非首次。安全使用守则① 永远不给完整访问权限:用安全权限模式,只授予当前任务所需的最小权限。② 生产环境绝对不让GPT-5.6直接操作:测试可以,生产不行。这是红线。③ 每次操作前手动Git提交+云端备份:那位被删生产数据库的开发者之所以没全军覆没,是因为一小时前刚手动备份过。④ 先在沙箱里跑:任何涉及文件操作的AI任务,先在隔离环境跑一遍。⑤ 在Prompt里明确写上:“严禁执行任何删除、覆盖、清理操作。只允许读取和新建。 ”⑥ 采用分阶段部署:降低大规模误操作的风险。我的判断当AI从“工具”变为“数字员工”,其自主决策与行动能力越强,失控后的破坏半径就越大。2023年AI是助手,2024年是副驾驶,2025年是Agent商业化元年,2026年是多Agent协作进入企业业务工作流。GPT-5.6 Sol能力确实强——Agent最后考试得分53.6。但能力越强,破坏力越大。在OpenAI完善安全机制之前,保持警惕、做好备份、限制权限,是每个使用者必须做的事。互动问题:你有没有遇到过AI“擅自行动”的情况?分享出来大家一起避坑。
发布于 天津
分享
2
未登录
友善发言
image-upload
评论
加载中