今天,百度正式發布文心大模型 5.1。
有兩件事我覺得值得嘮嘮,方向都挺有意思。
————
1、搜索能力
文心 5.1 以 1223 分登上 LMArena Search Arena 搜索榜,國內第一、全球第四。圖三
更關鍵的是,它是這個榜單上目前唯一上榜的國產模型。
所謂「搜索能力」,早就不是我們以為的「上網搜答案」。
它考驗的是模型能不能同時看多個信息源,再把結果整合成一個更靠譜、更一致的回答。
說白了,AI 胡編亂造的老毛病,這次多少能松點氣了。
百度把自己最熟的老本行,重新打回了大模型時代的牌桌中央。
2、預訓練成本
文心 5.1 用的是「多維彈性預訓練」,文心 5.0 那會兒就放過風的一套技術。
帶來的結果挺直接,總參數壓到約 1/3,激活參數壓到約 1/2。圖四
預訓練成本,只有業界同規模模型的約 6%。(ps..從deepseek開始,大家都在預訓練成本上卷起來了- -)圖五
翻了下今天放出的技術報告,做法其實挺巧:文心 5.1 不是從零起訓,而是從文心 5.0 的「子模型族」里直接抽出一個最優子網,把 5.0 的知識完整繼承過來。圖六
再配合一套 Once-For-All 彈性訓練框架,在深度、寬度、稀疏度三個維度上動態調節,一次訓練就能產出多種規模的模型。
不重頭訓,成本自然就被壓下去了。而且搜索榜上的成績也說明:能力并沒有被明顯犧牲。
報告見:https://ernie.baidu.com/blog/posts/ernie-5.1-0508-release/
————
這次發布,正好在 5.13號 百度 Create 2026 大會前,很好奇現場還有什么大招。
百度在搜索這件事上的積累不是吹出來的,二十多年的老本行。
老本行碰上大模型這一波,還能整出哪些「花活」?
到時候我會和AI KOL們一起去現場,給大家帶回第一手觀察。
#LMArena #AI #AI大模型 #文心 #文心大模型 #百度Create大會2026
![]()
![]()
![]()
![]()
![]()
![]()
![]()
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.