王西蒙AI创客
2天前·AI领域创作者
今天你被工作耽误吃饭了吗
SuperCLUE发布了2026编程大模型测评。GLM-5.2(max)以64.13分位居全场最高。但单题成本4.35元。Kimi-K2.7-Code拿到55.43分,单题成本2.97元。GLM确实强,但也确实贵。Kimi性价比更高。五款国产模型真实工程任务对比,DeepSeek V4 Pro、Kimi K2.6、Qwen 3.7 Max、GLM 5.1、MiniMax M3,从可运行性、正确性、可读性、可维护性四个维度量化评分。结论是各有千秋,没有一款在所有维度上都领先。Qwen3.7-Max以1541分闯入全球前四。阿里在编程上确实能打。智谱发布GLM-5.3,编程与智能体能力接近Claude Fable 5,编程体感超过其他国产模型。GLM-5.3得分84.5%,高于GLM-5.2的77.2%。国产模型在编程上的进步确实快,但"接近"和"超越"之间还差着一个量级。
发布于 中国香港
分享
评论
未登录
友善发言
image-upload
评论
加载中