王西蒙AI创客
1天前·AI领域创作者
GLM-5.3正式上线,写代码到底啥水平
8月14日智谱发了GLM-5.3,API在8月19日正式上线。7430亿参数,基座没动全靠后训练。智谱说自己Code Bench上比上一代提升了50%。自己给自己打分,还是自家的考试,这成绩单得打个折扣。但实测表现确实有进步。从零交付了一个可交互的3D开放世界网页Demo,还写了电影感宣传片渲染脚本和《大闹天宫》小游戏的代码。全程只输入设计规格和验收标准,输出代码直接能跑,几乎不用人工调整。从"能写代码"到"能交付完整项目",这是质变。DeepSWE从46.2%涨到66.9%,Terminal-Bench从4.6%涨到28.3%。看着涨了不少,但66.9%意味着还有三分之一的复杂任务搞不定。写个Demo可以,写个生产级系统试试。有开发者实测发现,在复杂算法题上GLM-5.3仍落后Claude和GPT约8分。GLM-5.3写代码的真实水平大概就是"能写、能跑、但别太复杂"。做个网页Demo没问题,写个《大闹天宫》小游戏也可以,但要它独立完成一个企业级项目还差得远。
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn