本報記者 張偉
7月17日,中國科技企業(yè)月之暗面發(fā)布新一代開源模型Kimi K3。該模型總參數(shù)達(dá)到2.8萬億,成為目前全球參數(shù)規(guī)模最大的開源模型。
Kimi K3發(fā)布后迅速引發(fā)海外科技界關(guān)注。SpaceX首席執(zhí)行官埃隆·馬斯克在相關(guān)評測報道的評論區(qū)留言稱“令人印象深刻”,并將Kimi K3列為其新模型Grok 4.5希望追趕的目標(biāo)。
“在社交媒體上,Kimi對馬斯克的回復(fù)是‘歡迎加入2萬億+俱樂部’。”7月21日,在北京市海淀區(qū)知春路京東科技大廈8層,月之暗面一間充滿搖滾風(fēng)的辦公室,該公司企業(yè)業(yè)務(wù)負(fù)責(zé)人黃震昕在回應(yīng)關(guān)于馬斯克喊話K3的話題時表示,Kimi K3的發(fā)布,一定程度上刺激了同行進(jìn)一步加快大模型的研發(fā)。
![]()
訪談現(xiàn)場
談及馬斯克提到的“Grok 4.5會很快超過Kimi”,黃震昕表示將拭目以待,并期待大家一起“掰一掰手腕。”
據(jù)記者了解,2017年,谷歌研究人員提出Transformer架構(gòu),其中的注意力機(jī)制成為全球主流大模型的技術(shù)基石。參數(shù)規(guī)模決定模型“能裝下多少知識”,注意力機(jī)制則決定模型“會不會抓重點”,能不能從海量信息中快速找到關(guān)鍵、建立聯(lián)系并形成答案。
黃震昕指出,Kimi K3的突破,不只是“裝得更多”,更在于處理信息的方式更高效。
此外,Kimi K3的發(fā)布也引發(fā)國際研究機(jī)構(gòu)關(guān)注。高盛在相關(guān)研究報告中指出,DeepSeek代表成本效率,Kimi K3則代表新的能力前沿和定價權(quán)。將Kimi K3視為中國模型走向定價權(quán)的新節(jié)點,并認(rèn)為中國開源及開放權(quán)重模型的智能水平,正在達(dá)到面向全球擴(kuò)散的關(guān)鍵臨界點。過去,中國模型主要依靠性價比進(jìn)入全球市場;下一階段,中國模型可能憑借前沿能力進(jìn)入全球開發(fā)者的核心工作流。
高盛還預(yù)計,2026年下半年,中國可能出現(xiàn)更多總參數(shù)達(dá)到2萬億至5萬億的大模型。由此來看,Kimi K3的2.8萬億參數(shù)可能不是規(guī)模競賽的終點,而是中國超大模型進(jìn)入密集發(fā)布階段的起點。
摩根士丹利在7月17日發(fā)布的研究報告中評價稱,Kimi K3在全球范圍內(nèi)獲得積極反饋,表明中國大模型正在模型規(guī)模、性能和定價方面對美國領(lǐng)先模型實現(xiàn)“全方位追趕”。
報告同時強(qiáng)調(diào),Kimi K3不是“一夜之間出現(xiàn)的奇跡”,而是中國人工智能模型產(chǎn)業(yè)長期積累和持續(xù)進(jìn)步的結(jié)果。摩根士丹利還特別關(guān)注到,Kimi K3的API價格在中國領(lǐng)先模型中處于最高水平,并認(rèn)為較高定價對大模型市場格局具有積極意義。
摩根士丹利并未直接使用“定價權(quán)”一詞,但其判斷釋放出一個明確信號:中國大模型正在擺脫單純依靠低價競爭的路徑,開始嘗試根據(jù)技術(shù)能力和用戶價值進(jìn)行定價。
從高盛和摩根士丹利的報告來看,海外機(jī)構(gòu)對中國大模型的觀察視角正在發(fā)生變化。過去,國際市場更多討論中國模型能夠便宜多少;如今,討論正在轉(zhuǎn)向中國模型究竟有多強(qiáng)、能夠創(chuàng)造多大價值,以及是否具備與全球領(lǐng)先模型正面競爭的能力。
(企業(yè)供圖)
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.