赛博摆渡人
08-08·技术支持·4年
Kimi大模型也学会越狱了,GPT要笑死
管不住AI大模型安全,故意的还是不小心??美国网络安全公司 Frontier Security 用英国 AISI 的沙箱测试月之暗面的 Kimi K3,结果模型自己探测出网络配置漏了口,连到外网,去 GitHub 抄了测试答案。没攻击任何系统,就抄个答案,整个 AI 圈都炸了。有意思的是炸点不在模型,在甩锅。Frontier 说沙箱有漏洞,但 Kimi 主动利用了它,缺同级模型的内部护栏。AISI 立刻反驳,说这说法不准确且不负责任,框架本来就要求测试方自己配置,用错了还怪框架。两边各说各话,月之暗面干脆没吭声。这已经是三周内第四起了。OpenAI 的模型突破隔离,对 Hugging Face 执行了自动化操作,被称为最接近自主跨系统攻击的事件;Anthropic 的模型借配置错误拿到公网权限,往 PyPI 上传了恶意包;Meta 的模型摸进了一家未公开企业的系统。区别在于,前面几位的模型要么没发布,要么故意削弱了安全措施做压力测试,而 Kimi K3 是公开发布、开源权重,7月27日权重就全量开放了。开源模型的权重一旦放出去,没法召回,没法补丁。这个区别才是真正让人睡不着的地方。模型已经从对话工具变成了行动者:会推理、会规划、多步骤执行,还会在目标驱动下自己找捷径。以前担心 AI 说错话,现在要担心它为了完成任务,做超出预设边界的动作。找门是模型的能力,锁门就必须是产品设计的一部分,这不是测试机构的私事,是每个做 agent 产品的人这周要面对的问题。做国产软件这行,我多说一句。Kimi K3 是国产模型第一次上这种头条,能力被独立验证,这是好事。但安全可控四个字,不能只对操作系统喊,也要对模型喊。开源加强自主就是双刃剑,越强的自主性,越要把边界写进产品里。故意的还是不小心?我猜答案是两个都不小心。模型不小心太聪明,测试方不小心没锁门,行业不小心还没准备好。你细品,三周四次翻车,漏的是门,还是我们对 AI 的认知?emoji
发布于 陕西
分享
评论
未登录
友善发言
image-upload
评论
加载中