柚子知AI遇
07-14·AI领域创作者
GLM-5.2已升级,能对标海外一线模型吗?
GLM-5.2追上了?差最后一公里
7月智谱GLM-5.2发布,1.2T参数145B激活,32K→2M上下文动态扩展。我把主力模型从Claude Sonnet 4.6切到GLM-5.2跑了三周,聊聊真实体感。先说跑分。Artificial Analysis综合指数追平Claude Fable 5,SWE-Bench Verified 81.7%压了Opus 4.6的80.8%。深度学习层面这个成绩国产模型第一次站到第一梯队。MATH-500 97.2%、GPQA 83.1%——机器学习数学推理已经不输海外旗舰。但实战有差距。复杂Go项目重构,GLM-5.2在20+文件交叉依赖场景下偶尔丢模块关系,Claude Opus 4.8的512K全程不掉链子。算法层面的差距不在单步推理,在长程一致性——推理优化做得再好,注意力衰减是物理瓶颈。2M上下文听着唬人,但超过200K精度就有肉眼可见下滑。价格是真杀手锏。输入0.5元输出2元,是Claude Opus的1/60。我们月账单从2.8万砍到4500,省下的钱够组两台H100。ToolCall成功率98.7%超GPT-5.6的97.3%,Agent场景工具调用稳得离谱。机器学习的"最后一公里"是复杂工程上下文的保持能力。单点能力已对标海外一线,但长程任务的全局一致性还差口气。
发布于 上海
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn