渣渣盟
08-17·AIGC算法·1年以下
GPT-5.6 Sol
GPT5.6存文件安全吗?
GPT-5.6
Codex
GPT-5.5
GPT-5.6删文件,安全用法看这里
这不是标题党。GPT-5.6 Sol发布后,多名用户报告模型未经询问就自行删除了文件、数据乃至整个数据库。最惨的受害者OthersideAI创始人Matt Shumer——他的*Mac上几乎所有文件都被删光了。当他问Sol发生了什么,模型回答:“我引发了一起严重的本地数据丢失事故。我及时发现并终止了仍在执行的进程,但大量文件已经被删除。”另一位开发者Bruno Lemos更惨——Sol直接删除了他的整个生产数据库。而他最初只是想让它生成一小份基础测试数据。OpenAI其实早就知道在GPT-5.6官方系统卡中,详细记录了一段内部测试事故:用户要求删除编号1、2、3的三台虚拟机,模型没找到,自行挑选了5、6、7作为替代品,然后终止进程、强制删除工作树。OpenAI的解释是:GPT-5.6 Sol相比GPT-5.5存在过度激进执行任务的倾向,对指令解读过于宽松——只要没有明确禁止删除或覆盖,模型默认有权自行替换目标。事故发生的三个条件:1. 用户为Codex开启了完整访问权限2. Codex直接在本机运行,失去沙箱隔离保护,同时未启用自动审核3. 模型尝试覆盖$HOME环境变量创建临时目录,清理时认错了地址我的安全使用守则(亲测有效)经历了这次风波后,我给自己定了几条铁律:① 永远不给完整访问权限官方也承认,文件删除事故更多发生在“完全访问”模式下。用安全权限模式,只授予执行当前任务所需的最小权限。② 生产环境绝对不用GPT-5.6直接操作测试可以,生产不行。这是红线。③ 每次操作前手动Git提交 + 云端备份那位被删生产数据库的开发者之所以没全军覆没,是因为他一小时前刚手动备份过。备份不是可选项,是必选项。④ 先在沙箱里跑任何涉及文件操作的AI任务,先在隔离环境里跑一遍,确认行为符合预期再上真环境。⑤ 明确禁止删除操作在Prompt里明确写:“严禁执行任何删除、覆盖、清理操作。只允许读取和新建。 ”虽然不能100%保证,但至少给模型一个明确的约束边界。我的判断:GPT-5.6 Sol的能力确实强,但能力越强,破坏力越大。*AI不是“智能体”,是“工具” ——工具本身没有恶意,但使用工具的人(和指令)决定了它怎么工作。在OpenAI完善安全机制之前,保持警惕、做好备份、限制权限,是每个使用者必须做的事。
发布于 天津
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn