竹帘听雨
07-14·人力HR·10年+
GLM-5.2已升级,能对标海外一线模型吗?
GLM-5.2 综合实力迈入全球开源第一梯队,代码工程、超长文本处理表现突出,部分场景可对标 Claude Opus 4.8 这类海外顶尖闭源模型,不过通用推理上限、推理速度、底层复杂系统搭建能力仍存在小幅差距。在 Terminal-Bench、FrontierSWE 等专业代码评测中,它和 Claude Opus 4.8 分数差距仅 1%-4%,在开源模型里优势明显,可独立完成完整开发工程任务;上下文支持百万 Token 无损读取,能稳定解析完整代码库、海量长文档,超长文本能力比肩海外旗舰,优于不少闭源模型。整体来看,国内开源模型在代码、长文本赛道大幅缩小与海外头部产品的差距,但综合通用能力仍有追赶空间。
发布于 贵州
1
评论
未登录
友善发言
image-upload
评论
加载中