王西蒙AI创客
1天前·AI领域创作者
GLM-5.3正式上线,写代码到底啥水平
8月14日智谱发了GLM-5.3,API在8月19日正式上线。7430亿参数,基座没动全靠后训练。智谱说自己Code Bench上比上一代提升了50%。自己给自己打分,还是自家的考试,这成绩单得打个折扣。但实测表现确实有进步。从零交付了一个可交互的3D开放世界网页Demo,还写了电影感宣传片渲染脚本和《大闹天宫》小游戏的代码。全程只输入设计规格和验收标准,输出代码直接能跑,几乎不用人工调整。从"能写代码"到"能交付完整项目",这是质变。DeepSWE从46.2%涨到66.9%,Terminal-Bench从4.6%涨到28.3%。看着涨了不少,但66.9%意味着还有三分之一的复杂任务搞不定。写个Demo可以,写个生产级系统试试。有开发者实测发现,在复杂算法题上GLM-5.3仍落后Claude和GPT约8分。GLM-5.3写代码的真实水平大概就是"能写、能跑、但别太复杂"。做个网页Demo没问题,写个《大闹天宫》小游戏也可以,但要它独立完成一个企业级项目还差得远。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中