视觉和多模态的人,正在从海外实验室回到国内大厂。7月9日,田永龙加入腾讯大语言模型部。
田永龙此前是OpenAI研究员,这次参与的是视觉语言模型,也就是让模型同时处理图像和文字,而不只是纯文本对话。履历是:清华大学本科,香港中文大学硕士,麻省理工学院博士,导师Phillip Isola;主导过开源项目SupContrast;之后在Google Research、Google DeepMind和OpenAI工作,方向集中在机器视觉和多模态生成。
他和腾讯首席AI科学家姚顺雨是清华本科校友,也在OpenAI同过事。姚顺雨2025年加入腾讯,负责AI Infra部和大语言模型部。Infra,白话就是训练和部署模型的底层工程,不是面向用户的聊天窗口。腾讯近两年对外的落地包括混元模型、WorkBuddy智能体,以及游戏里的AI生成工具。田永龙进的是模型部,和这几条产品线是同一家公司里的不同层。
把时间拉近,原文把三件事放在一起:SpaceX AI联合Cursor做新模型,Meta发布Muse Image,田永龙加盟腾讯。共同点是海外实验室的人和成果在向外走。中美之间的流动,被描述为从个别案例变成成批发生。腾讯、字节、阿里、百度在补多模态、视觉和智能体,而不是只补对话模型。
对国内大厂,这是基础研究补人。对OpenAI、Anthropic、Google DeepMind,这是人被挖走、方法可能跟着走的压力。原文没有写薪酬和团队规模,不能把“加入”写成已经带出整支队伍。
SupContrast是他主导过的开源项目,方向在视觉表征,和这次做视觉语言模型是同一条线。Phillip Isola是MIT阶段的导师。Google Research、DeepMind、OpenAI三段,覆盖的是视觉和多模态生成。姚顺雨负责AI Infra和大语言模型部,提供的是工程平台和模型岗位。腾讯已有混元、WorkBuddy和游戏生成工具,缺的是视觉侧的人,不是从零组建AI部门。
能核对的是履历和入职部门。下一步看混元或视觉模型的发布说明里,会不会出现他负责的方向,而不是只停留在人员新闻。