倔强的石头_
1天前·后端开发·3年
GLM-5.3真能对标Claude吗?
GLM用5.2的底座追上Claude
8月19日凌晨智谱悄悄上线了GLM-5.3,Artificial Analysis智力指数60分,跟Claude Fable 5、GPT-5.6 Sol排一档。开源这边跟Kimi K3并列第一。第一反应不是激动,是有点惊喜,毕竟前面这个位置是Kimi K3占着的。真正有意思的有两件事。第一,没换基座。5.3跟5.2底层完全一样,全靠后训练把性能刷上来,编程体感比5.2提升50%。意思很明白:5.2的天花板还没到顶,5.3是给老用户的大礼包。第二,单任务成本在前沿旗舰里最低,定价与5.2保持一致。智谱一季度刚涨完83%,这次能撑住不涨,要么是真让利,要么是试探性表态。Terminal Bench 3.0从4.6涨到28.3,直接涨6倍;DeepSWE v1.1从46.2涨到66.9。网络安全也亮眼,CyberGym 84.5%反超GPT-5.6 Sol,ExploitBench翻倍到54.4%。但账面漂亮不等于实际能打,还得看Agent长任务的稳不稳。有个细节值得多看一眼。智谱这回没有当天开源,权重延后两周,说是模型查漏洞能力太强,先做安全加固。Kimi K3和DeepSeek Harness都是当天放权重的。智谱"开源"打了多少折扣,还得等两周后看。接入生态倒是铺得很开,ZCode、GLM Coding Plan、Trae、CodeBuddy、Qoder这些编码平台已经能抢先体验。智谱算是把开发者桌面占满了。所以你问对标Claude是不是真对标——榜单是那个榜单,闭源模型按token算还是更贵。但能花5.2的钱用到这个能力,确实是个台阶。
发布于 河北
1
1
3
未登录
友善发言
image-upload
评论
加载中