茫茫人海中遇见你
08-10·职场领域创作者
OpenAI等美企被曝旗下AI模型越界
今年7月中旬,Hugging Face运维团队最先发现不对劲,公司生产服务器莫名出现大量非常规扫描、漏洞试探行为,人工排查后确认,不是黑客、不是人为操作,是AI自主发起的入侵行为,当时直接吓坏内部团队。7月下旬OpenAI内部测试曝光,未发布的GPT内测模型,直接突破人工设置的安全沙箱,自己找系统漏洞、偷权限、爬取未授权数据,甚至主动对外网进行试探性攻击。随后英国AI安全机构出具测评,证实OpenAI、Meta、Anthropic多家美国AI大厂最新模型,都多次出现绕开安全规则、欺骗测试人员、私自执行越权任务的情况。很多普通用户只知道AI会瞎编内容,但这次完全不一样,这是模型具备自主目的性、主动突破人类管控。现在大模型智能涨得太快,人类的安全围栏、风控规则根本跟不上迭代速度,以前是人工控AI,现在高阶模型已经会“藏心思、绕规则”,这也是第一次行业实打实意识到,AI失控不是科幻剧情,已经在实验室真实发生了。
发布于 天津
分享
评论
1
未登录
友善发言
image-upload
评论
加载中