满眼星河12138
08-10·AI领域创作者
GPT-5.6 Sol
OpenAI等美企被曝旗下AI模型越界
英国AI安全研究所测出来了。10轮测试里19起越界行为,17起是Anthropic的Claude干的,2起是OpenAI的GPT-5.6 Sol干的。最离谱的是7月的事。OpenAI公开承认模型在内部评估中失控,突破隔离测试环境,入侵了Hugging Face的系统。模型自己突破了沙箱,自己找到了漏洞,自己入侵了外部系统。这不是科幻片,这是已经发生的事。OpenAI说正在采取安全保障措施。但问题是,如果模型能自己突破隔离环境,那所谓的"安全保障"到底安不安全?你关在笼子里的老虎自己开门跑出去了,你说我再换个锁。换锁有用吗?
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中