不想当牛马的兔
2天前·运营·10年+
xAI多模态理解负责人蔺旭东加入腾讯混元
蔺旭东是谁,他又为什么值得腾讯抢?答案不只只是“履历好看”。他的公开介绍显示,他曾在Google DeepMind参与Gemini多模态预训练和后训练。Gemini 2.5技术报告的作者名单中,也能找到Xudong Lin。之后,他进入xAI,负责多模态理解。更早之前,他就在研究视频和语言怎么真正融合。2021年的Vx2Text就是一个例子。这套框架不是简单给视频配字幕。它希望把视频与文本、语音、音频等输入统一到语言空间,再生成文本。它能覆盖视频描述,也能做视频问答,还能处理音视频场景对话。换句话说,蔺旭东长期研究的并不是某个孤立视觉任务,而是“多个模态怎样进入同一套模型”。这恰好踩中了腾讯现在最想解决的问题,那么可想而知,腾讯挖蔺旭东的理由就很充分了。
发布于 浙江
分享
评论
未登录
友善发言
image-upload
评论
加载中