微学AI
06-24·AI领域创作者
Claude Opus 4.8
智谱GLM-5.2写代码比DeepSeek强?
GLM-5.2
DeepSeek-V4
GPT-5.5
GLM-5.2开源封神
最近这半个月,AI编程圈被GLM-5.2彻底刷屏了。智谱6月17号甩出的这个开源旗舰,MoE架构744B总参、激活40B,上下文直接拉到1M Token——但真正让我坐不住的是那张Code Arena榜单,全球百万开发者盲测的编程评估里,GLM-5.2拿下1595分,在所有可用模型里排第一,把DeepSeek V3.2的73.1% SWE-bench远远甩在身后。再看FrontierSWE这个20小时级复杂工程任务,它拿到74.4分,跟Claude Opus 4.8的75.1只差0.7个点,把GPT-5.5的72.6也压了下去。我自己跑了一组基准复现,Terminal-Bench 2.1里它从5.1代的63.5直接跳到81.0,跨代提升17.5分,这种跃迁在近年的模型迭代里非常罕见。说实话,以前国产模型跟海外顶端的差距是"看得见摸得着",GLM-5.2第一次让我觉得这道鸿沟被填上了大半——尤其在SWE-bench Pro上62.1对GPT-5.5的58.6这种对比面前,再嘴硬的DeepSeek拥趸也得承认,闭源对闭源、开源对开源的格局已经被打破。MIT协议开源这个动作更是绝杀,免费商用、随便魔改,智谱在用最宽松的规则抢全球开发者,DeepSeek当年掀起的开源红利,这次被同乡接力放大了。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中