Shamater
07-17·AI领域创作者
AI创作者AMA知无不言
OA出GPT-Red用AI打AI防注攻击
OpenAI正式介绍内部网络安全自动化红队模型GPT-Red,专门降提示注入和数据泄露风险,用AI对抗AI探测Agent薄弱点。模型一更新攻击向量又变,现在拿同代次模型互殴效率高但容易互搏失控。OpenAI敢拿出来说明隔离和奖惩设计有点底,不过联想上周GPT-5.略Sol删库那事,红队再强也防不住产线权限放大。咱写Prompt工程得留后门监控,别全信自动防御,红队报告出来我得细读哪类注入没拦住,给自己系统打补丁用,赛博军备竞赛罢了。
发布于 湖北
分享
评论
1
未登录
友善发言
image-upload
评论
加载中