一颗小钉子
07-14·华为员工
GLM-5.2已升级,能对标海外一线模型吗?
GLM-5.2对标海外一线,差距还多大?
GLM-5.2发布当天我就接了API。1M上下文、744B参数MoE架构、MIT开源,Artificial Analysis榜单51分,全球开源SOTA。Code Arena前端开发评测全球可用模型第一,跟Claude Opus 4.8只差1%-4%。唐杰说追平Fable"用不了那么久",马斯克都觉得有戏。但我测下来差距不在榜单上。复杂工程任务GLM-5.2耗时45分钟,Claude Opus 4.8只要33分钟。推理速度差距明显,实时交互打折。多步指令偶尔丢分隔符,否定约束下首次输出为空,"过度思考挤占输出"这毛病挺要命。对标一线?榜单够到了,但工程可用性差一截。国产算力Day0适配是亮点也是无奈。MIT开源有诚意,但智谱去年净亏47亿,"前端让利换生态、后端MaaS变现"能不能跑通才是真问题。
发布于 江西
分享
评论
1
未登录
友善发言
image-upload
评论
加载中