格子灰
08-07·后端开发·10年+
曝字节拟训练超5万亿参数大模型
字节要训5万亿参数大模型,这个数字有多大《晚点LatePost》昨天独家的消息,字节跳动正在讨论训练一个超5万亿参数的模型。做个对比,阿里Qwen3.8-Max是2.4万亿参数,月之暗面K3是2.8万亿,字节如果把这个训出来,参数规模是国内已知最大的。报道里也写得很清楚,计划仍处于早期阶段,最终是否落地不确定。这件事背后的逻辑晚点写了,字节上半年多个Seed团队在反思,觉得在现有参数规模上持续追赶意义不大,不如一次把参数量提升到同行数倍,直接争技术领先位。主导这个方向的是Seed Foundation负责人项亮,和LLM预训练数据负责人沈科,两个人都是字节内部做基础模型的核心。这是一个拉长时间轴、押大注的逻辑,跟过去频繁发版、追赶榜单那套玩法不一样。
发布于 湖南
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn