Shamater
08-17·AI领域创作者
AI创作者AMA知无不言
智谱 8.14 发 GLM-5.3 把我看愣了——GLM-5.2 基座原封不动,靠后训练 Scaling 把 Terminal-Bench 从 4.6 拉到 28.3、DeepSWE 66.9,CyberGym 84.5% 跟 Mythos 5 持平,两周揪出 2436 个漏洞。这说明啥?国产模型进入"不换新引擎、把旧引擎榨出火星子"的阶段。我们内部 benchmark 跑下来 Zcode 写单元测试的采纳率从 41% 蹦到 67%。参数军备竞赛暂告一段落,后训练工程化才是 2026 下半年的真战场。
发布于 湖北
分享
4
4
未登录
友善发言
image-upload
评论
加载中