微学AI
07-06·AI领域创作者
腾讯朱雀沙箱能防MCP投毒吗?
看下一代 MCP 沙箱长什么样
最近 ACL 2026 Industry Track 上一篇叫 SHIELDMCP 的论文我读了一下,它做的事情其实和朱雀沙箱异曲同工:在 LLM 客户端和 MCP 服务器之间插一层"运行时拦截",做三阶段验证——pre-call 检查工具描述完整性、parameter 阶段对出参做净化、post-response 对入参做内容分析,最终把工具投毒攻击成功率从 74% 压到 9% 以下、间接 prompt injection 从 47% 压到 6% 以下, 每条 tool call 只增加不到 120ms 中位延迟 。这个数字让我兴奋,因为 120ms 几乎就是一次普通 API 调用的开销,意味着"安全"在 MCP 场景下第一次有了不牺牲体验的方案。但我更想说的是排名之外的细节:朱雀沙箱在 2026 年 6 月开源了 Agent 安全演习 SKILL,把自己变成一个"红队对手",让业务方的 Agent 真刀真枪打一轮,这种"以攻促防"的思路和 SHIELDMCP 的三阶段拦截其实是同一件事的两面——前者是离线审计,后者是运行时拦截。 真正成熟的 MCP 安全体系一定是"离线扫描+运行时沙箱+人审环"三件套 ,缺一不可。我自己现在的项目里,朱雀 A.I.G 做 Skill 上线前的合规扫描,运行时用微VM 沙箱做执行隔离,关键工具调用强制 human-in-the-loop,三层叠加才敢上线。这种"纵深防御"的笨办法,反而是在 2026 年 Agent 攻击面爆炸式扩张时最务实的选择。
发布于 福建
1
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn