大厂职场观察者
08-12·测试·5年+
GPT推出网络安全专用模型,亮点在哪?
GPT-5.6 Sol
95% vs 1.5%,这个数据太扎眼了
OpenAI给GPT-5.6-Cyber搞了个内部评估叫“高级网络安全完成率”。测什么呢?就是看模型对漏洞利用链开发、权限提升、认证绕过这类请求响应不响应。结果:GPT-5.6-Cyber完成了95%,GPT-5.6 Sol只有1.5%,上一代GPT-5.5-Cyber是57.3%。95%意味着什么?意味着安全研究员问10个专业问题,模型能答9个半。以前问10个被拒9个半。有安全公司反馈说,GPT-5.6-Cyber一天干完了此前模型几周都没搞定的活。这种效率提升在漏洞挖掘这种高度依赖人力的领域,影响还是挺大的。当然,目前只有通过Daybreak Red审核的合作伙伴才能用。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中