不想当牛马的兔
2天前·运营·10年+
xAI多模态理解负责人蔺旭东加入腾讯混元
蔺旭东是谁,他又为什么值得腾讯抢?答案不只只是“履历好看”。他的公开介绍显示,他曾在Google DeepMind参与Gemini多模态预训练和后训练。Gemini 2.5技术报告的作者名单中,也能找到Xudong Lin。之后,他进入xAI,负责多模态理解。更早之前,他就在研究视频和语言怎么真正融合。2021年的Vx2Text就是一个例子。这套框架不是简单给视频配字幕。它希望把视频与文本、语音、音频等输入统一到语言空间,再生成文本。它能覆盖视频描述,也能做视频问答,还能处理音视频场景对话。换句话说,蔺旭东长期研究的并不是某个孤立视觉任务,而是“多个模态怎样进入同一套模型”。这恰好踩中了腾讯现在最想解决的问题,那么可想而知,腾讯挖蔺旭东的理由就很充分了。
发布于 浙江
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn