微学AI
08-13·AI领域创作者
GPT推出网络安全专用模型,亮点在哪?
GPT-5.6 Sol
95%完成率:模型学会不拒绝
最近我翻到 OpenAI 那篇 Daybreak 公告,看到 "Advanced Cybersecurity Completion Rate" 这个指标时,手停了一下。GPT-5.6-Cyber 在漏洞利用链、身份验证绕过、权限提升这类任务上,完成率 95%。而同一个底座 GPT-5.6 Sol,标准防护下只有 1.5%,就算开了 Daybreak Blue 也才 2.0%。上一代专门的 GPT-5.5-Cyber 也就 57.3%,安全研究员吐槽了很久,根源就是这个拒绝率。说白了,这是个「学会不拒绝」的模型。它是在 GPT-5.6 Sol 上针对性训练的,目的就是把那些被通用护栏挡在门外的双用途请求接住。我自己在内部也带过安全工具链,太懂这种撕裂感了:同样的系统级筛查,防住了攻击者,也把正经的防御工作堵在门外。Blue 把这层去掉了,但像「对生产系统做渗透测试」这种高危提示,Blue 照样拒。Red 层的 GPT-5.6-Cyber 才真正放开。我心情挺复杂。作为撸代码的,看到模型能痛快干活当然爽;可一个会写利用链、能绕过认证的模型,门槛一旦放宽,对面那帮人拿到手也是同样顺滑。95% 这个数字,到底是防御者的盾,还是迟早流出去的矛?你们做安全的,会放心把这种权限交给模型吗?评论区聊聊。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中