微学AI
07-15·AI领域创作者
GLM-5.2已升级,能对标海外一线模型吗?
开源 SOTA,GLM 时刻已来
最近 Artificial Analysis Intelligence Index v4.1 榜单更新,智谱 GLM-5.2 以 51 分冲到全球第四、开源第一,把 Gemini 全系都压在身后。排在前面的依次是 Claude Fable 5(60 分)、Opus 4.8(56 分)、GPT-5.5 xhigh(55 分)。看到这份榜单时我有一种久违的"中国时刻"——上一次国产模型在权威综合榜摸到这个位置,还是 DeepSeek V3 刚冒头的时候。但和那次不同,GLM-5.2 没有靠堆参数:总参 744B、激活 40B,跟上一代 5.1 几乎一模一样,所有提升都来自训练侧。CritPt +16 到 21%、Humanity's Last Exam +12 到 40%、Terminal-Bench v2.1 +16 到 78%、AA-LCR +9 到 71%,每一项都是两位数跳升。在 GDPval-AA v2 这个"模拟真实工作"的代理任务上,GLM-5.2 拿到 1524 分,比 GPT-5.5 xhigh 的 1514 还高一点——一个开源权重模型,在最像"打工"的测试上干掉了最贵的闭源对手。Vercel CEO Guillermo Rauch 看后直接说"This will change the game",从 GPT-4 时代国产模型"望其项背",到 Claude 3.5 时代的"各有千秋",再到 Fable 5 因出口管制缺席、GLM-5.2 实打实补位到第四——这不是"对标",而是真实存在的"卡位"。我更关心的是,下半年 Fable 5 重新开放后,智谱还能不能继续守在第一梯队。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中