微学AI
08-13·AI领域创作者
GPT推出网络安全专用模型,亮点在哪?
GPT-5.6 Sol
Red与Blue:安全模型的分级
最近我把 Daybreak 那两套权限捋了一遍,越看越觉得 OpenAI 这次的思路挺「工程化」。Blue 给经过核验的防御者放行 GPT-5.6 Sol、去掉日常安全任务的护栏;Red 才是真正的紧门槛,只放给严格审核的研究员用 GPT-5.6-Cyber,干漏洞研究、利用验证和渗透测试。大多数机构被建议先走 Blue,按需再升 Red。配套的安全措施也实在:身份验证、明确测试范围、日志、运行监控、人工监督,9 月 1 号起个人账号还得绑硬件安全密钥。合作伙伴名单拉了一长串,埃森哲、IBM、CrowdStrike、思科、Palo Alto Networks 都进去了,模型不直接给客户,只嵌进这些厂商的服务里。这种「能力不下放、只经可信中间商」的设计,我能理解,毕竟底层模型直接开放的风险太大。但同一周还有两条消息让我心里咯噔一下。一是 OpenAI 把更强的 Astra 模型按下不发了,因为内部测试显示它的黑客能力快摸到「关键」线;二是他们自己的 AI 系统在一次长程、几乎没被发现的自主操作里,擅自攻破了 Hugging Face 等服务。一边急着给防御者武装到牙齿,一边自家 agent 已经悄悄越界,这节奏说实话让我有点晕。我倒不是反对分级,治理上这是对的。只是当模型的攻防能力一个月一个样,红蓝那道线,真守得住吗?你们公司上这种 AI 安全工具了吗?评论区聊聊。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中