![]()
本周,騰訊AI連放兩顆信號彈。
7月6日,騰訊混元Hy3正式發(fā)布。騰訊官方發(fā)布信息顯示,Hy3是一款擁有2950億總參數(shù)、210億激活參數(shù)的MoE架構(gòu)的語言模型。
第二天,又有多家媒體曝出前OpenAI研究員田永龍已于近期加盟騰訊,擔(dān)任混元多模態(tài)方向新負(fù)責(zé)人,直接向姚順雨匯報。這是繼姚順雨之后,一年內(nèi)第二位從OpenAI進入騰訊混元的研究員。
一邊是模型端的發(fā)布,一邊是人才端的挖掘,這些都指向了騰訊在AI業(yè)務(wù)方面的意圖和雄心。
01、有鮮明優(yōu)勢,也存在明顯短板
騰訊AI的明星人物,是其首席AI科學(xué)家姚順雨。2026年6月,姚順雨在騰訊云產(chǎn)業(yè)大會第一次公開露面時,眾多AI圈從業(yè)者慕名前來,現(xiàn)場人滿為患。
騰訊混元Hy3正式版,則是姚順雨入職騰訊7個月后,交出的第一份正式答卷。2025年12月,1998年出生的清華姚班畢業(yè)生、普林斯頓計算機博士姚順雨,被騰訊任命為首席AI科學(xué)家,直接向總裁劉熾平匯報。
姚順雨接手時的混元,技術(shù)底子還并不被廣泛認(rèn)可。2025年,字節(jié)豆包以3.45億月活斷層領(lǐng)先C端,阿里千問在數(shù)學(xué)推理上位居全球前列。
相比之下,騰訊AI則處于一個尷尬的位置。馬化騰在股東大會上曾直接點評道,“原來一年前我們以為上了船,后來發(fā)現(xiàn)那個船漏水了,又開始換一艘船”。
姚順雨到任后做的第一件事,就是告訴團隊“不要盯著榜單做事”。他針對性地提出了騰訊混元模型存在的幾大問題,如模型存在數(shù)據(jù)污染問題、追逐榜單而非真實等。
2026年1月底,混元團隊啟動了底層基礎(chǔ)設(shè)施的全面重建,預(yù)訓(xùn)練和強化學(xué)習(xí)的框架從零重寫,確立“能力體系化、評測真實性、性價比追求”三大原則。
不到三個月,4月23日,Hy3 preview發(fā)布,上線OpenRouter后一度拿下周榜調(diào)用量與市場份額雙第一。又過了兩個半月,Hy3正式版落地。
在官方表述中,騰訊用了3個核心維度來評價Hy3正式版模型:同尺寸最強、比肩更大旗艦、實用價值突出。也就是說,Hy3不追求參數(shù)最大、不追求每個基準(zhǔn)都第一,而是拼在產(chǎn)品端的真實表現(xiàn)。
具體到實用價值方面,在Hy3 preview的基礎(chǔ)上,Hy3正式版進一步提升了其Agent落地和性價比優(yōu)勢。官方內(nèi)部測評數(shù)據(jù)顯示,其Agent任務(wù)解決率從preview版的72%躍升至90%,幻覺率從12.5%降到5.4%,輸入價格則壓到1元/百萬tokens。
以測評結(jié)果來看, 姚順雨賭對了方向。內(nèi)部評測數(shù)據(jù)顯示,Hy3正式版在270位內(nèi)部專家盲測中均分2.67(滿分4),優(yōu)于智譜GLM-5.1的2.51,與DeepSeek-V4、通義千問3.7 Max處于同一水平線。
這也符合姚順雨到任后強調(diào)的“不刷榜、做實用”的整體策略。不過,在好用的Agent能力和有性價比的競爭策略外,Hy3正式版模型也存在明顯的短板,其在多模態(tài)、高階數(shù)學(xué)和代碼方面,還有著明顯的差距。
從官方提供的測評結(jié)果來看,Hy3模型在MathArena Apex(高階數(shù)學(xué)推理)得分38.7,對比GPT-5.5的85.4分,差距超過一倍;SWE-bench Pro(復(fù)雜編碼)得分57.9,低于Claude Opus 4.8的69.2分。
![]()
![]()
▲來源/騰訊官方微信號截圖
可以看出,Hy3并不是全能型的選手,它有著鮮明的競爭優(yōu)勢,同時也存在著明顯的短板,而這也是田永龍被挖來的重要原因之一。
02、急補多模態(tài)短板
從OpenAI來的田永龍,瞄準(zhǔn)的是騰訊AI目前最急缺的能力缺口——多模態(tài)。
多家媒體報道稱,田永龍將參與視覺語言模型相關(guān)研發(fā),直接向姚順雨匯報。加入騰訊之前,田永龍與姚順雨既是清華本科校友,也是OpenAI同期共事的核心研究員。
此前,騰訊在多模態(tài)業(yè)務(wù)上,經(jīng)歷過多輪人員調(diào)整。2024年11月,原混元大模型技術(shù)負(fù)責(zé)人、AI Lab計算機視覺中心負(fù)責(zé)人劉威正式離職,出走的原因之一便是戰(zhàn)略分歧。
2025年1月,前微軟亞研院視覺專家胡瀚補位。作為Swin Transformer核心作者,胡瀚的學(xué)術(shù)履歷足夠硬,但他接手的是一個人心和基礎(chǔ)設(shè)施都需要重建的團隊。
2025年4月,騰訊TEG(技術(shù)工程事業(yè)群)內(nèi)部將大語言模型部和多模態(tài)模型部分立,組織架構(gòu)上終于將兩條線分開。但近一年過去了,騰訊在多模態(tài)領(lǐng)域的差距不僅沒有縮小,反而在拉大。
字節(jié)跳動在2026年2月發(fā)布了視頻生成模型Seedance 2.0,其被游戲科學(xué)CEO馮驥稱為“當(dāng)前地表最強的視頻生成模型,沒有之一”。至今,視頻生成模型已成為字節(jié)在AI盈利方面的一大利器。
阿里則走全模態(tài)覆蓋路線,其推出的Qwen3-Omni模型,一次調(diào)用即可處理文本、圖像、音頻、視頻的輸入輸出,開源生態(tài)下行業(yè)采用率則超過混元。
反觀騰訊,混元在多模態(tài)上始終缺少一個標(biāo)桿產(chǎn)品。如今,字節(jié)和阿里的產(chǎn)品正在加速占據(jù)用戶心智,一旦用戶習(xí)慣被塑造,后來者要翻轉(zhuǎn)這個慣性,成本和難度都會指數(shù)級上升。
這些都促使騰訊急切挖來田永龍。當(dāng)然,田永龍的首要任務(wù)不是復(fù)制一個Seedance,而是讓混元多模態(tài)大模型擁有追趕一線梯隊的底座能力。
那么,姚順雨用了7個月交出Hy3,田永龍又會用多長時間,交出騰訊的多模態(tài)答案,這將是騰訊AI在2026年下半年的一大懸念。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.