雪咤
07-18·全栈工程师·5年+
国产大模型开源,机器人进入加速期?
开源模型我选Qwen还是DeepSeek
最近开源大模型跟下饺子一样,阿里Qwen刚更新完多模态版本,腾讯Hy3直接以6.13万亿Token单周消耗登顶HuggingFace榜,DeepSeek V4 Flash之前霸榜好几周,智谱GLM-5.2还打了MIT许可证无限制商用。我们公司上周技术分享会,后端组推Qwen说生态好文档全,算法组吹DeepSeek说推理能力强,我作为全栈还得考虑落地成本——Qwen 72B量化后显存占用多少,Hy3的MoE架构在V100上能不能跑起来,这些才是真的要面对的问题。最后我选了个务实的路线:对外的智能客服用Hy3的API,响应快还便宜;内部敏感数据的工具用Qwen 14B本地部署,数据不出内网。国产开源模型现在真的够用了,但选型比写代码难多了,建议兄弟们别追榜单一味求大,看业务场景选最合适的。
发布于 广东
分享
评论
1
未登录
友善发言
image-upload
评论
加载中