騰訊再次官宣AI領域的組織架構調整,核心管理權交由姚順雨。
7月23日,騰訊宣佈混元多模態模型部門與大語言模型部門合併,成立基礎模型部,統一由“95後”騰訊首席AI科學家姚順雨管理,以進一步提升模型研發和協同效率,探索全模態模型的智能上限。
據騰訊方面表示,以大語言模型為基礎,騰訊混元構建了圖像、視頻、語音、3D生成模型等完整的模型矩陣。2026年以來,騰訊混元模型迭代速度不斷加快,與騰訊公司業務的協同也持續增強。
此次調整或與姚順雨在混元大模型方面交出的出色“成績單”有關。公開資料顯示,7月正式上線的大語言模型Hy3,展現出顯著強於同尺寸模型且比肩參數規模2-5倍的旗艦模型的智能水準,已在WorkBuddy/CodeBuddy、元寶、Marvis、ima等多個業務接入,API已在騰訊雲 TokenHub 以及多個海外平臺上線。發佈一周後, Hy3 總調用量較上一代模型(Hy2)增長超 68 倍,WorkBuddy自選模型的用戶中,選擇Hy3 的占比達到60%。
混元多模態模型也在持續進化。4月發佈並開源的混元3D世界模型2.0(HyWorld2.0)能夠根據文字、圖片、視頻等不同類型輸入,自動生成、重建和模擬3D世界,同時支持多格式3D資產導出,能與現有的遊戲工作流無縫對接,快速生成遊戲地圖和關卡原型。數據顯示,混元3D系列模型的社區下載量超過300萬,是全球最受歡迎的3D開源模型。混元圖像模型3.0在LMArena榜單上居國內開源模型第一。
澎湃新聞記者注意到,在頻繁的組織變陣下,混元團隊內部也出現一定人員調整。
記者瞭解到,前騰訊混元多模態理解負責人胡瀚或將離職創業。他曾擔任微軟亞洲研究院視覺計算組首席研究員。2025年初加入騰訊後,負責視覺大模型的研究。在後續的調整中,他加入大語言模型部旗下的“Frontier”前沿技術研究組,負責多模態理解的相關研究,彙報給姚順雨。
7月8日,OpenAI前研究員Yonglong Tian(田永龍)宣佈加入騰訊大語言模型部,後續將參與VLM(視覺語言模型)相關研發。
據公開資料顯示,田永龍此前在OpenAI的核心研究方向包括電腦視覺、視覺表徵學習(Representation Learning)以及生成式模型。在OpenAI之前,他曾在“穀歌系”深耕多年。2022年底,他加入位於劍橋的Google Research擔任高級研究科學家,隨後於2024年5月轉入Google DeepMind。
據瞭解,田永龍與現任騰訊首席科學家姚順雨有過OpenAI階段的共事經歷。
來源:中國澎湃新聞