8月19日消息,据爆料,xAI多模态理解负责人蔺旭东已经入职腾讯,头衔是混元多模态内容生成算法负责人。

同时今年7月,原多模态理解负责人胡瀚离职创业。
公开资料显示,蔺旭东2018年毕业于清华大学数理基础科学专业,随后赴哥伦比亚大学攻读博士,研究方向为嵌入学习、视频分析与生成模型。读博期间,他先后在腾讯、Facebook AI和谷歌实习。

在Facebook AI实习期间,他以第一作者身份参与了哥伦比亚大学与Facebook联合开发的多模态框架VX2TEXT,该框架通过多模态融合技术生成字幕,相关成果于2021年发布。

2024年1月至2025年10月,蔺旭东加入谷歌DeepMind,参与Gemini多模态预训练与后训练工作。
2025年11月,他加入xAI,出任多模态理解负责人,负责xAI多模态内容生成理解与生成模型的训练,至离职时在xAI任职约十个月。
近期,字节、阿里、腾讯均在对多模态团队进行重构。
6月,字节Seed架构调整,多模态负责人周畅接管机器人团队,具身智能纳入核心业务。原由李航负责的Seed Robotics团队转为向周畅汇报,具身智能被纳入多模态体系。
7月16日,阿里通义万相团队并入未来生活实验室,万相(文生图及视频)、Happy Horse(视频生成)、Happy Oyster(世界模型)三个多模态模型统一归入该实验室。
7月23日,腾讯宣布将混元大语言模型部与多模态模型部合并,组建“基础模型部”,由腾讯首席AI科学家姚顺雨统一负责。合并后,姚顺雨的管辖范围从大语言模型和AI Infra,扩展至文生图、文生视频、文生3D、数字人等全模态底层研发,向 TEG 总裁卢山汇报。原多模态模型部负责人薄列峰调整为向姚顺雨汇报。
OpenAI前研究员田永龙7月初入职腾讯大语言模型部,参与视觉语言模型(VLM)相关研发,向姚顺雨汇报。田永龙本科毕业于清华大学,博士毕业于MIT EECS,此后历经Google Research、Google DeepMind,2024年10月加入OpenAI,与姚顺雨同期共事。(AI普瑞斯)
扫码下载app 最新资讯实时掌握
