散峰而望
2天前·算法工程师·1年
GLM-5.3正式上线,写代码到底啥水平
国产编程模型谁最强?
最强要分领域
在编程这一块得看领域,像前端方面Kimi无疑是最优选择,后端方向GLM和Deepseek是我个人觉得可以用的很好的模型。目前Deepseek大幅度涨价,我也开始去看向其他性价比高的模型,参照了一些测评和个人使用习惯上,GLM是本人用的能力比较稳定。同时GLM5.3用更小的参数规模跑到世界模型前列,完成一个任务的平均成本大约是 0.6 美元,Claude Fable 5 则要 3 美元出头,这让我感到不错。在个人的GLM5.3测试中,GLM5.3 还做了多轮回退演练,每修一个漏洞,就先撤掉补丁,确认对应测试会变红,再还原复测。我也随机抽了一条,把实现改回旧版本,新增测试当场失败;恢复修复后,47 条测试重新全绿。对比Deepseek在相关测试中还会有大大小小的漏洞,需要不断的提示明确一些边界情况。总而言之,国产模型谁最强,没有确定的说法,仅仅看跑分是远远不够的,真正落实到场景业务中,所呈现的效果也有所不同。反正模型纯粹是自己用的舒不舒服,好模型我自会去买单。
发布于 河南
2
1
2
未登录
友善发言
image-upload
评论
加载中