问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年7月业内传出重磅人事动态,OpenAI前研究员田永龙已加入腾讯,或将出任混元多模态模型方向负责人,主导视觉语言模型(VLM)研发。作为腾讯混元继姚顺雨后引入的又一核心AI人才,田永龙Google Scholar引用量近3万次,其加盟标志着腾讯正加速多模态大模型领域的技术布局。

当前全球大模型产业正处于从单模态文本交互向多模态全场景感知跃迁的关键节点,视觉语言融合技术的迭代速度,直接决定了AI产品未来的落地边界与竞争力,头部科技公司围绕核心研发人才的争夺也日趋白热化,腾讯此次的人事变动正是这一趋势下的典型信号。
尽管腾讯尚未官宣此次人事调整,但相关消息已经在AI学术圈与产业界引发广泛关注。田永龙是计算机视觉领域的顶尖学者,本科毕业于清华大学,硕士阶段在香港中文大学MMLab深造,后于麻省理工学院取得博士学位,研究方向覆盖传统视觉识别、生成模型、表征学习等多个核心领域,个人Google Scholar引用量已接近3万次。
值得注意的是,田永龙是腾讯混元团队继姚顺雨之后引入的第二位有OpenAI核心研发背景的人才,二人此前曾在OpenAI共事,共同参与过GPT系列模型及多模态技术的迭代研发,配合基础扎实,二人的组合也被业内视为腾讯混元多模态技术研发的核心班底。
视觉语言模型(VLM)被业内公认为是下一阶段大模型落地的核心技术支点,能够打通文本、图像、视频等多类型信息的理解与生成能力,可广泛应用于内容创作、智能客服、自动驾驶感知、工业质检、智能家居交互等多个场景,市场空间广阔。
此前腾讯混元大模型已经完成了多轮迭代,相关能力已经接入微信、QQ、腾讯游戏、云服务等多个内部业务场景,此次引入田永龙主导多模态技术研发,显然是要进一步补齐混元在视觉相关能力上的短板,加快相关技术的落地速度,抢滩多模态大模型的市场份额。
随着大模型技术迭代进入深水区,兼具前沿学术研究能力与工业化落地经验的顶尖人才已经成为各家科技公司争抢的核心资源。据业内统计,当前全球顶尖AI研发人才的缺口已经超过10万人,仅多模态方向的核心研究员缺口就超过2万人。
近半年来,国内多家头部科技公司都在加大海外顶尖AI人才的引进力度,腾讯接连引入两位OpenAI核心研发人员,也反映出国内科技企业在AI核心技术研发上的投入持续加码,未来国内大模型的技术迭代速度有望进一步加快。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。