坐下双手合十
08-16·AI领域创作者
千问办公首发上线GLM-5.3等前沿模型
有意思的是,它没有换基座,还是 GLM-5.2 那个基础模型,提升主要来自后训练,也没有改架构。分数看起来确实不小。Terminal Bench 3.0 从 4.6 到 28.3,这个跨度有点夸张。DeepSWE v1.1 从 46.2 到 66.9。Z.ai 自己的 Code Bench 也写了提升 50%。token 效率也变高了:GLM-5.3 大约 75K 输出 token 做 34.5% 的任务,上一代要 96K 才做 23.4%。和 DeepSeek V4-Pro-0813 比,不是全赢。
发布于 上海
分享
评论
未登录
友善发言
image-upload
评论
加载中