键盘敲碎了雾霾
2天前·AI领域创作者
国产编程模型谁最强?
国产编程模型谁最强?
这周太热闹了!DeepSeek V4 Pro、智谱GLM-5.3、阿里Qwen3.8扎堆发布,编程能力集体跃升。我拿同一套LeetCode hard和真实开源项目bug修复任务测了一遍(非官方benchmark),简单说下主观感受:GLM-5.3:软件工程基准从4.6飙到28.3,智能体编码从46.2升到66.9,实测多轮对话改bug很稳,上下文理解到位。DeepSeek V4-Pro:综合评测53分,比Flash版40分提升明显,Agent调度能力强,配合Harness插件化很灵活。Qwen3.8-Max:在某些基准上得分78.5,但实测复杂逻辑生成偶尔会“想当然”,需要人工纠偏。个人排名(纯主观):GLM-5.3在严格代码规范上略胜,DS V4 Pro在任务编排上更顺手,Qwen3.8性价比依然高。你们用哪个最多?评论区聊聊。#国产大模型 #AI编程 #模型横评 #GLM #Qwen
发布于 湖南
分享
1
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn