满眼星河12138
23小时前·AI领域创作者
GLM-5.3正式上线,写代码到底啥水平
智谱说GLM-5.3编程体感比上一代提升了50%。基座没变,全靠后训练硬拉上去的。一个基座能反复榨出性能,说明当初设计的时候确实留了余量。真实的代码能力到底怎么样。DeepSWE从46.2%涨到66.9%,Terminal-Bench 3.0从4.6跳到了28.3。Terminal-Bench这个涨幅确实吓人,但起点低也是事实。从4.6到28.3,翻了六倍多,但28.3分在真实工程里到底够不够用,还得看实测。内部Code Bench评测说整体提高了大约50%。有开发者对比了Grok 4.5和GLM-5.3的编程能力,结论是差距不大,主要差在生成代码的风格和兜底能力上,日常开发基本无感。差距不大,但风格和兜底能力这种东西,在复杂工程里可能就是能不能用的区别。GLM-5.3写简单代码确实够用,写复杂工程还得看具体场景。一周后开放权重,到时候开发者自己测了才知道。
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn