有干劲的巴顿在跳伞
1天前·AI领域创作者
GLM-5.3真能对标Claude吗?
GLM-5.3真能对标Claude吗
智谱 GLM-5.3 刚发布,参数还是 7430 亿,跟上一代一样大,但后训练搞出了 50% 的体感提升。官方数据很猛:Terminal-Bench 3.0 从 4.6 飙到 28.3,DeepSWE v1.1 从 46.2 干到 66.9,Z.ai Code Bench 最高档 31.4%,超过 Claude Opus 4.8 的 29.5%,而且平均只用 5 万 tokens,Claude 要 12 万。数据确实漂亮,但我作为一个被 benchmark 骗过无数次的程序员,第一反应是:它能帮我改 legacy 代码里的祖传 bug 吗?Benchmark 是标准化考场,真实项目是开放世界。很多模型在评测里能写 Three.js _demo,到了我公司那个没文档、没注释、依赖版本混乱的老项目里,照样抓瞎。不过这次 GLM-5.3 有两点值得注意:一是它没有堆参数,纯靠后训练把能力拉上去,说明这条路走得通;二是编程工具 ZCode、AutoClaw 已经上线了,两周内还要开源完整权重。对开发者来说,多一个免费/便宜的选择总是好事。我的判断:Claude 还没被超越,但 GLM-5.3 已经从"国产替代"变成了"可以真用"。做程序员、算法工程师、技术负责人的朋友,建议申请个额度试试,别只看 PPT。你们用 GLM-5.3 写过代码吗?实际体验如何?评论区交流。
发布于 安徽
分享
1
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn