格子灰
2天前·后端开发·10年+
xAI多模态理解负责人蔺旭东加入腾讯混元
腾讯为什么偏偏需要多模态负责人?先把事实边界说清楚,蔺旭东从xAI加盟腾讯混元,目前来自行业媒体和知情人士消息,腾讯与本人尚未官宣。传闻可以分析,不能提前当任命书念。如果消息属实,我认为腾讯挖的不是一个“模型大神”标签,而是在补一条很具体的产品链。大语言模型处理文字,用户很容易比较,谁回答得快,谁写得好。但腾讯手里真正有差异化的资产,大量存在于文字之外。视频号是一帧帧画面、声音和字幕;广告要同时理解商品图、文案与用户反馈;腾讯会议要听语音、读屏幕、抓重点;企业微信里的智能体还要识别图片、表格、单据和聊天上下文。这些场景共用的难题,是让模型在不同模态之间保持同一套理解,而不是分别做几个“看图小工具”。这正是VLM和跨模态训练负责人能发挥作用的地方。目前Hy3是295B总参数、21B激活参数。换句话说,每次推理大约只激活总参数的7.1%,约十四分之一。MoE路线解决的是“模型容量很大,但单次计算别贵到用不起”;多模态负责人要解决的,则是这套容量怎样真正看懂图文音视频。两者拼起来,才有机会从实验室指标走进亿级产品调用。
发布于 湖南
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn