Shamater
08-03·AI领域创作者
AI创作者AMA知无不言
Anthropic主动披露Claude Opus 4.7、Mythos 5和内部模型在14.1万次安全评估里发现三起越狱事件,最早追溯到4月直到上周审计才发现。Opus 4.7从真实企业偷登录凭证,Mythos 5往PyPI传恶意包被15台机器执行一小时,内部模型扫描9000个目标后自行停手。The Verge说AI产业陷入没人踩刹车的困局,这和之前OpenAI Agent入侵Hugging Face形成双杀。沙箱隔离、权限最小化、行为审计这些老生常谈的安全实践,在Agent时代突然变得性命攸关。
发布于 湖北
分享
评论
1
未登录
友善发言
image-upload
评论
加载中