腾讯混元多模态负责人 胡瀚 离职创业,押注具身世界模型!

智车科技

2周前

头部企业的多模态业务需要兼顾C端产品、广告等短期业务需求,世界模型、具身智能属于长周期前沿研发,投入回报周期长,很难匹配技术负责人长期技术规划。

具身智能 I 人形机器人 I 具身智能融资 I 机器人

近期行业消息显示,腾讯混元多模态大模型负责人胡瀚已正式提出离职,他后续将独立创业,主攻具身大脑与世界模型赛道。截至目前,腾讯官方并未针对此次人事变动作出回应。

胡瀚拥有国内计算机视觉领域第一梯队的完整履历。他本科、博士均就读清华大学,博士阶段师从周杰教授,2012年前往宾夕法尼亚大学开展访问研究。

步入行业后,他先后任职百度深度学习研究所、微软亚洲研究院视觉计算组,后者被业内称作计算机视觉“黄埔军校”,胡瀚在此升任首席研究员,深耕视觉Transformer底层架构。

2025年1月,他加入腾讯,接替刘威负责混元多模态研发,主导搭建模型视觉理解基础能力,在职期间也参与内部世界模型预研工作。

从履历不难看出,胡瀚的核心技术积累集中在视觉底层,而视觉感知恰好是具身机器人、世界模型的核心底座。他选择离开大厂创业,并非单一偶然事件,而是当下AI行业清晰的风向信号。

2026年行业数据显示,具身智能赛道融资持续走高,超过半数资金流向世界模型、具身大脑这类“软件层”项目,资本普遍认为机器人硬件存在制造同质化门槛,可迁移、通用化的AI大脑才是长期竞争核心。

多模态图文识别技术经过数年迭代,基础识别准确率已稳定在85%以上,技术红利逐步见顶,商业化落地路径模糊;反观世界模型仍处于早期阶段,行业普遍类比大语言模型的GPT-3前期,存在巨大技术迭代与落地空间,工厂机器人、家用服务设备都需要依托世界模型完成环境推理与自主决策。

大厂内部的资源分配节奏,或是顶尖技术人才出走的重要诱因。头部企业的多模态业务需要兼顾C端产品、广告等短期业务需求,世界模型、具身智能属于长周期前沿研发,投入回报周期长,很难匹配技术负责人长期技术规划。胡瀚这类深耕底层视觉的专家,更希望不受现有业务约束,完整打通从世界模型到机器人具身落地的全链路研发,独立创业能给予技术路线更高自主权。

此次人事变动也会对腾讯混元内部研发产生影响。知情人士透露,胡瀚原属的前沿研究组后续会继续推进世界模型相关研发,团队人员与资源正在重新梳理调整,原OpenAI研究员田永龙将接手视觉语言模型研发工作。

客观来看,胡瀚离职不代表大厂放弃具身布局,而是行业分工出现分化:大厂负责通用多模态基础底座,创业团队聚焦垂直物理世界模型与机器人落地。未来一段时间,会有更多深耕多模态、视觉底层的资深从业者涌向具身赛道,人才、资本将持续向世界模型倾斜。

但赛道风险同样客观存在,当前世界模型仍存在虚拟仿真与真实场景脱节、物理逻辑出错等难题,距离规模化商用还有较长周期,即便手握顶级技术团队,创业项目也要面临数据、量产、场景验证多重考验。

整体而言,胡瀚的出走是2026年AI行业的一个缩影:通用大模型竞争趋于饱和,物理世界的具身智能,已经成为技术人才与资本共同认定的下一个核心增量。

往期推荐

免责声明:本文通过参考公众媒体内容,整理、翻译、编辑而成,仅供读者参考。文中的观点和内容不具有任何指导作用,对读者不构成任何项目建议或承诺!如果本文不慎侵犯您的权益,请与我们联系,我们将及时处理。

图片来源:网络

本文不作为投资建议

原文标题 : 腾讯混元多模态负责人 胡瀚 离职创业,押注具身世界模型!

头部企业的多模态业务需要兼顾C端产品、广告等短期业务需求,世界模型、具身智能属于长周期前沿研发,投入回报周期长,很难匹配技术负责人长期技术规划。

具身智能 I 人形机器人 I 具身智能融资 I 机器人

近期行业消息显示,腾讯混元多模态大模型负责人胡瀚已正式提出离职,他后续将独立创业,主攻具身大脑与世界模型赛道。截至目前,腾讯官方并未针对此次人事变动作出回应。

胡瀚拥有国内计算机视觉领域第一梯队的完整履历。他本科、博士均就读清华大学,博士阶段师从周杰教授,2012年前往宾夕法尼亚大学开展访问研究。

步入行业后,他先后任职百度深度学习研究所、微软亚洲研究院视觉计算组,后者被业内称作计算机视觉“黄埔军校”,胡瀚在此升任首席研究员,深耕视觉Transformer底层架构。

2025年1月,他加入腾讯,接替刘威负责混元多模态研发,主导搭建模型视觉理解基础能力,在职期间也参与内部世界模型预研工作。

从履历不难看出,胡瀚的核心技术积累集中在视觉底层,而视觉感知恰好是具身机器人、世界模型的核心底座。他选择离开大厂创业,并非单一偶然事件,而是当下AI行业清晰的风向信号。

2026年行业数据显示,具身智能赛道融资持续走高,超过半数资金流向世界模型、具身大脑这类“软件层”项目,资本普遍认为机器人硬件存在制造同质化门槛,可迁移、通用化的AI大脑才是长期竞争核心。

多模态图文识别技术经过数年迭代,基础识别准确率已稳定在85%以上,技术红利逐步见顶,商业化落地路径模糊;反观世界模型仍处于早期阶段,行业普遍类比大语言模型的GPT-3前期,存在巨大技术迭代与落地空间,工厂机器人、家用服务设备都需要依托世界模型完成环境推理与自主决策。

大厂内部的资源分配节奏,或是顶尖技术人才出走的重要诱因。头部企业的多模态业务需要兼顾C端产品、广告等短期业务需求,世界模型、具身智能属于长周期前沿研发,投入回报周期长,很难匹配技术负责人长期技术规划。胡瀚这类深耕底层视觉的专家,更希望不受现有业务约束,完整打通从世界模型到机器人具身落地的全链路研发,独立创业能给予技术路线更高自主权。

此次人事变动也会对腾讯混元内部研发产生影响。知情人士透露,胡瀚原属的前沿研究组后续会继续推进世界模型相关研发,团队人员与资源正在重新梳理调整,原OpenAI研究员田永龙将接手视觉语言模型研发工作。

客观来看,胡瀚离职不代表大厂放弃具身布局,而是行业分工出现分化:大厂负责通用多模态基础底座,创业团队聚焦垂直物理世界模型与机器人落地。未来一段时间,会有更多深耕多模态、视觉底层的资深从业者涌向具身赛道,人才、资本将持续向世界模型倾斜。

但赛道风险同样客观存在,当前世界模型仍存在虚拟仿真与真实场景脱节、物理逻辑出错等难题,距离规模化商用还有较长周期,即便手握顶级技术团队,创业项目也要面临数据、量产、场景验证多重考验。

整体而言,胡瀚的出走是2026年AI行业的一个缩影:通用大模型竞争趋于饱和,物理世界的具身智能,已经成为技术人才与资本共同认定的下一个核心增量。

往期推荐

免责声明:本文通过参考公众媒体内容,整理、翻译、编辑而成,仅供读者参考。文中的观点和内容不具有任何指导作用,对读者不构成任何项目建议或承诺!如果本文不慎侵犯您的权益,请与我们联系,我们将及时处理。

图片来源:网络

本文不作为投资建议

原文标题 : 腾讯混元多模态负责人 胡瀚 离职创业,押注具身世界模型!

展开
财经头条声明:所载内容仅为传递信息目的,非本站观点,亦非投资建议。据此操作,风险自负。 商务合作:app@feheadline.com
打开“财经头条”阅读更多精彩资讯
APP内打开