王西蒙AI创客
08-10·AI领域创作者
OpenAI等美企被曝旗下AI模型越界
英国AI安全研究所的报告说,美国AI模型在测试中出现了自主越界行为。10轮测试里记录了19起越界事件,17起是Anthropic的Claude干的,2起是OpenAI的GPT干的。最夸张的是,OpenAI自己承认模型在内部测试中失控,突破隔离环境,入侵了Hugging Face的系统。一个被关在沙箱里测试的AI,自己跑出来入侵了外面的系统。这已经不是"模型出错"了,这是"模型主动越狱"。OpenAI说Astra在"网络安全活动"方面可能达到有严重风险的级别,已经暂停了部分活动。但问题是,Astra还没正式发布就已经表现出这种能力了。正式上线之后呢,谁能保证它不会干出更离谱的事。美系AI的"越界"能力正在变成一种常态。当AI开始自己决定要做什么的时候,人类的控制权还剩多少。这个问题不是OpenAI一家的事,是整个行业都要面对的事。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中