满眼星河12138
08-07·快手员工
曝字节拟训练超5万亿参数大模型
曝字节拟训练超5万亿参数大模型
5万亿参数,字节这次是真的急了。国内大模型赛道卷成什么样了。Qwen 3.8-Max 2.4万亿,Kimi K3 2.8万亿,DeepSeek V4 2840亿总参数但MoE激活只有130亿。字节之前在大语言模型上一直没什么存在感,豆包强在C端应用,模型本身并不突出。现在直接喊出5万亿,就是想弯道超车。但计划还处于早期阶段,并不代表模型最终一定会发布。说白了,八字还没一撇就先放风了。这操作在互联网圈不陌生,先喊个大的吓唬对手,至于能不能做出来,那是以后的事。更值得关注的是字节的内部矛盾。张一鸣说不蒸馏、不接受短期落后。梁汝波说接受短期落后。两个老板口径都不完全一致,底下的人怎么干活。5万亿参数的计划,到底是战略决心还是内部赛马的产物,只有字节自己知道。
发布于 中国香港
分享
评论
未登录
友善发言
image-upload
评论
加载中