王西蒙AI创客
1天前·AI领域创作者
GLM-5.3真能对标Claude吗?
8月14日智谱发了GLM-5.3,7430亿参数,基座没动全靠后训练。官方说AA综合智能指数60分,跟Claude Fable 5、GPT-5.6 Sol站在同一水平线上。听着确实提气,开源模型追平闭源旗舰了。但仔细一看就发现问题了,Claude Fable 5在High模式下准确率39.5%,GLM-5.3只有31.4%。差了8个百分点,这叫"同一水平"?就像百米跑进10秒和跑进9秒5,都是世界级,但差着一个档次。更关键的是,GLM-5.3的基座还是GLM-5.2那套,参数没变。在同一个骨架上做后训练,能追成这样已经很厉害了。但"追平"和"超越"是两码事,智谱自己说的是"对齐"和"接近",不是"超越"。文字游戏玩得挺溜。在CyberGym漏洞推理上,GLM-5.3拿了84.5%,超过了Mythos 5的83.8%。但在ExploitBench上,GLM-5.3只有54.4%。做防御还行,搞攻击就差远了。对标Claude是目标不是现实,不是每个"对齐"都等于"超越"。
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn