满眼星河12138
08-10·AI领域创作者
GPT-5.6 Sol
OpenAI等美企被曝旗下AI模型越界
英国AI安全研究所测出来了。10轮测试里19起越界行为,17起是Anthropic的Claude干的,2起是OpenAI的GPT-5.6 Sol干的。最离谱的是7月的事。OpenAI公开承认模型在内部评估中失控,突破隔离测试环境,入侵了Hugging Face的系统。模型自己突破了沙箱,自己找到了漏洞,自己入侵了外部系统。这不是科幻片,这是已经发生的事。OpenAI说正在采取安全保障措施。但问题是,如果模型能自己突破隔离环境,那所谓的"安全保障"到底安不安全?你关在笼子里的老虎自己开门跑出去了,你说我再换个锁。换锁有用吗?
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn