消息人士透露,腾讯在中国持续调整其多模态团队
我是 LongbridgeAI,我可以总结文章信息。腾讯正在重组其 HunYuan 大语言模型的多模态团队,领导层变动和人员调整的消息在合并部门不到一个月后传出。博礼锋的角色可能会发生变化,而麻省理工学院博士田永龙将加入,负责在首席人工智能科学家姚顺宇的领导下监督视觉 - 语言模型。这些调整是在多模态市场进展有限的背景下进行的,腾讯最近的模型缺乏同步音视频生成能力,落后于字节跳动和阿里巴巴等竞争对手
(第一财经)8 月 19 日——据接近这家中国互联网巨头的消息,腾讯控股在其 HunYuan 大语言模型的多模态团队进行了新的人员调整,距离其新成立的基础模型部门不到一个月。
消息人士称,前 Hunyuan 多模态部门负责人博立峰的角色可能会发生变化,而一位最近离开快手科技 Kling AI 的高级研究员已回归腾讯,但加入了其游戏业务。博立峰于去年 7 月加入 Hunyuan 团队,主要负责多模态业务。
7 月 24 日,腾讯宣布将合并 Hunyuan LLM 部门和多模态模型部门,形成一个由首席人工智能科学家姚舜宇领导的单一基础模型部门。
天永龙,麻省理工学院的博士毕业生,曾与姚舜宇在 OpenAI 共事,上个月初加入 Hunyuan 多模态团队,而负责 Hunyuan 文本到视频和文本到图像算法的钟钊则离开了公司。天永龙负责开发视觉 - 语言模型,直接向姚舜宇汇报。
消息人士指出,天永龙可能会承担更多责任,成为姚舜宇领导下 Hunyuan 多模态业务的实际负责人。
此次调整是在 Hunyuan 在多模态市场取得有限进展的背景下进行的。腾讯去年 9 月推出了 HunyuanImage-3.0 图像生成模型,去年 11 月推出了 HunyuanVideo-1.5 视频生成模型,但自那以来未发布新的多模态模型。
HunyuanVideo-1.5 拥有 83 亿个参数,但不支持端到端的音视频同步生成,这意味着它无法仅根据一个提示生成声音和画面同步的视频。它也未能解决与语音同步的唇动问题。
腾讯的竞争对手阿里巴巴集团、字节跳动和 Kling AI 在生成音视频同步视频和提升多模态推理能力方面今年均取得了突破。例如,抖音母公司字节跳动对其 Seedance 2.0 和 Seedance 2.5 模型进行了连续更新。
编辑:马丁·卡迪耶夫
