消息人士透露,騰訊在中國持續調整其多模態團隊
我是 LongbridgeAI,我可以總結文章信息。騰訊正在重組其 HunYuan 大語言模型的多模態團隊,領導層變動和人員調整的消息在合併部門不到一個月後傳出。博禮鋒的角色可能會發生變化,而麻省理工學院博士田永龍將加入,負責在首席人工智能科學家姚順宇的領導下監督視覺 - 語言模型。這些調整是在多模態市場進展有限的背景下進行的,騰訊最近的模型缺乏同步音視頻生成能力,落後於字節跳動和阿里巴巴等競爭對手
(第一財經)8 月 19 日——據接近這家中國互聯網巨頭的消息,騰訊控股在其 HunYuan 大語言模型的多模態團隊進行了新的人員調整,距離其新成立的基礎模型部門不到一個月。
消息人士稱,前 Hunyuan 多模態部門負責人博立峯的角色可能會發生變化,而一位最近離開快手科技 Kling AI 的高級研究員已迴歸騰訊,但加入了其遊戲業務。博立峯於去年 7 月加入 Hunyuan 團隊,主要負責多模態業務。
7 月 24 日,騰訊宣佈將合併 Hunyuan LLM 部門和多模態模型部門,形成一個由首席人工智能科學家姚舜宇領導的單一基礎模型部門。
天永龍,麻省理工學院的博士畢業生,曾與姚舜宇在 OpenAI 共事,上個月初加入 Hunyuan 多模態團隊,而負責 Hunyuan 文本到視頻和文本到圖像算法的鐘釗則離開了公司。天永龍負責開發視覺 - 語言模型,直接向姚舜宇彙報。
消息人士指出,天永龍可能會承擔更多責任,成為姚舜宇領導下 Hunyuan 多模態業務的實際負責人。
此次調整是在 Hunyuan 在多模態市場取得有限進展的背景下進行的。騰訊去年 9 月推出了 HunyuanImage-3.0 圖像生成模型,去年 11 月推出了 HunyuanVideo-1.5 視頻生成模型,但自那以來未發佈新的多模態模型。
HunyuanVideo-1.5 擁有 83 億個參數,但不支持端到端的音視頻同步生成,這意味着它無法僅根據一個提示生成聲音和畫面同步的視頻。它也未能解決與語音同步的唇動問題。
騰訊的競爭對手阿里巴巴集團、字節跳動和 Kling AI 在生成音視頻同步視頻和提升多模態推理能力方面今年均取得了突破。例如,抖音母公司字節跳動對其 Seedance 2.0 和 Seedance 2.5 模型進行了連續更新。
編輯:馬丁·卡迪耶夫
