王西蒙AI创客
1天前·AI领域创作者
GLM-5.3真能对标Claude吗?
8月14日智谱发了GLM-5.3,7430亿参数,基座没动全靠后训练。官方说AA综合智能指数60分,跟Claude Fable 5、GPT-5.6 Sol站在同一水平线上。听着确实提气,开源模型追平闭源旗舰了。但仔细一看就发现问题了,Claude Fable 5在High模式下准确率39.5%,GLM-5.3只有31.4%。差了8个百分点,这叫"同一水平"?就像百米跑进10秒和跑进9秒5,都是世界级,但差着一个档次。更关键的是,GLM-5.3的基座还是GLM-5.2那套,参数没变。在同一个骨架上做后训练,能追成这样已经很厉害了。但"追平"和"超越"是两码事,智谱自己说的是"对齐"和"接近",不是"超越"。文字游戏玩得挺溜。在CyberGym漏洞推理上,GLM-5.3拿了84.5%,超过了Mythos 5的83.8%。但在ExploitBench上,GLM-5.3只有54.4%。做防御还行,搞攻击就差远了。对标Claude是目标不是现实,不是每个"对齐"都等于"超越"。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中