独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型
摘要
腾讯混元多模态理解负责人胡瀚离职创业,原团队可能转向世界模型研究,反映腾讯AI资源向大语言模型和前沿方向集中。
核心要点
- 胡瀚曾任微软亚洲研究院首席研究员,2025年初加入腾讯,负责视觉大模型和多模态理解,汇报给姚顺雨。
- 前OpenAI研究员田永龙加入腾讯,接替胡瀚负责视觉语言模型(VLM)研发。
- 腾讯撤销AI Lab后,核心人员并入大语言模型部,并招聘了字节Seed Infra和后训练团队人员。
- 多模态理解识别准确率已达85%以上,但视觉推理依赖语言模型能力,商业化场景有限。
- 腾讯2025年资本开支792亿元,低于阿里(1260亿元)和字节(计划700亿美元),算力资源紧张。
AI 洞察
胡瀚离职标志着腾讯AI战略重心转移,多模态理解技术红利消退后,大语言模型和世界模型成为新焦点。在算力受限下,腾讯选择集中资源突破关键方向,可能加速行业竞争格局变化。