![]()
這是一個(gè)在朋友圈刷屏了好幾周的故事,然后突然安靜了。
今年2月,中國(guó)AI大模型在OpenRouter平臺(tái)上的周調(diào)用量首次超越美國(guó),隨后連續(xù)六周擴(kuò)大領(lǐng)先優(yōu)勢(shì)。高峰時(shí)期,全球調(diào)用量排名前六的全是中國(guó)模型,阿里千問3.6 Plus單周調(diào)用量一度達(dá)到4.6萬億Token,是美國(guó)模型總量的四倍以上。"中國(guó)AI全球第一"的標(biāo)題密集出現(xiàn),情緒達(dá)到頂點(diǎn)。
然后,數(shù)據(jù)翻轉(zhuǎn)了。
根據(jù)對(duì)OpenRouter最新數(shù)據(jù)的測(cè)算,4月13日至19日這周,中國(guó)AI大模型周調(diào)用量環(huán)比下跌23.77%,跌至4.44萬億Token;美國(guó)模型同期環(huán)比增長(zhǎng)20.62%,達(dá)到4.91萬億Token——近兩個(gè)月來首次反超中國(guó)。與此同時(shí),此前排名全球第一的阿里Qwen3.6 Plus已跌出前十榜單。
![]()
圖:《每日經(jīng)濟(jì)新聞》
熱鬧了兩個(gè)月的"中國(guó)AI全球領(lǐng)先",正在遭遇第一次真實(shí)的考驗(yàn)。
連漲十周的真相:是能力領(lǐng)先,還是爆款效應(yīng)?
2026年2月初,中國(guó)模型還只是OpenRouter平臺(tái)的追趕者。當(dāng)時(shí)美國(guó)模型占據(jù)平臺(tái)前十大模型調(diào)用總量近七成,中國(guó)模型不到兩成。轉(zhuǎn)折來得很突然。
MiniMax于2月13日發(fā)布M2.5模型,上線不足一周便登頂調(diào)用量榜首。僅M2.5一款模型,就貢獻(xiàn)了那一周平臺(tái)總調(diào)用量增量的近一半。緊接著,月之暗面的Kimi K2.5、智譜GLM-5、DeepSeek V3.2相繼發(fā)力,中國(guó)模型形成了集群式爆發(fā)。到3月底至4月初的最高峰,中國(guó)模型周調(diào)用量12.96萬億Token,是美國(guó)的4.27倍,全球前六全是國(guó)產(chǎn)。
但仔細(xì)看這輪爆發(fā)的結(jié)構(gòu),有一個(gè)細(xì)節(jié)耐人尋味:那段時(shí)間排名最靠前的Qwen3.6 Plus,有相當(dāng)大比例來自免費(fèi)額度用戶。OpenRouter平臺(tái)上,帶"free"標(biāo)簽的Qwen3.6 Plus (free)單周曾貢獻(xiàn)4.6萬億Token,是美國(guó)所有模型的總和。
免費(fèi)調(diào)用量激增,能反映真實(shí)的模型競(jìng)爭(zhēng)力嗎?這個(gè)問題,在本周數(shù)據(jù)出來后變得無法回避。
這次反轉(zhuǎn),Coding才是真正的分水嶺
大多數(shù)人以為這次逆轉(zhuǎn)是周期性波動(dòng),但分析師指向了一個(gè)更具體的原因。
AI行業(yè)分析師胡延平在接受媒體采訪時(shí)明確指出,上周美國(guó)AI大模型調(diào)用量回升,主要由Anthropic旗下Claude Sonnet和Opus模型拉動(dòng)——這兩款模型已成為編程(Coding)領(lǐng)域的"硬通貨",而國(guó)產(chǎn)大模型在這方面的產(chǎn)品力仍需提升。
數(shù)據(jù)印證了這個(gè)判斷。上周Claude Sonnet 4.6沖上全球榜首,周調(diào)用量1.38萬億Token,環(huán)比增長(zhǎng)19%;Claude Opus 4.6位居第三,周調(diào)用量1.22萬億Token。兩款模型合計(jì)占美國(guó)AI大模型周調(diào)用量逾五成。
與此形成對(duì)比的,是國(guó)產(chǎn)模型在編程場(chǎng)景的"過山車"表現(xiàn)。此前多次上榜的Kimi K2.5、智譜GLM系列,已連續(xù)三周未登榜;曾一度沖上榜單第二的階躍星辰Step 3.5 Flash,近兩周同樣無緣榜單。
編程場(chǎng)景的邏輯和通用問答不同。開發(fā)者選擇工具更理性、更挑剔,且用量穩(wěn)定、復(fù)購(gòu)率高。誰能在代碼生成、調(diào)試、工程化交付上贏得開發(fā)者信任,誰就掌握了調(diào)用量最穩(wěn)定的基本盤。Claude在這一場(chǎng)景的護(hù)城河,并非一兩周能被追平。
一個(gè)更大的背景:這場(chǎng)競(jìng)爭(zhēng)本來就不是"單線比拼"
這輪數(shù)據(jù)逆轉(zhuǎn)背后,斯坦福大學(xué)4月13日剛剛發(fā)布的《2026年人工智能指數(shù)報(bào)告》提供了更宏觀的注腳。
報(bào)告的核心判斷是:中美頭部模型性能差距繼續(xù)收斂,AI競(jìng)爭(zhēng)不再只是模型能力的單線比拼,而是逐步演化為模型、科研、產(chǎn)業(yè)、資本、算力和治理環(huán)境共同作用下的體系競(jìng)爭(zhēng)。
從這個(gè)視角看,調(diào)用量的一周逆轉(zhuǎn),遠(yuǎn)不是全部故事。
中國(guó)模型在某些維度上的優(yōu)勢(shì)是真實(shí)的。以上下文長(zhǎng)度為例,在10K-100K Token的任務(wù)里,MiniMax M2.5和DeepSeek V3.2是更多開發(fā)者的選擇;在超過100K Token的超長(zhǎng)上下文場(chǎng)景,MiniMax M2.5的優(yōu)勢(shì)更為明顯。這些都是傳統(tǒng)美國(guó)模型的弱項(xiàng)。
開源策略上,中國(guó)模型同樣形成了反直覺的競(jìng)爭(zhēng)優(yōu)勢(shì)。有數(shù)據(jù)顯示,80%的美國(guó)AI初創(chuàng)公司正在使用中國(guó)開源模型——美國(guó)試圖通過芯片管制構(gòu)筑壁壘,中國(guó)卻通過開源實(shí)現(xiàn)了更廣泛的滲透。
但短板同樣清晰。在響應(yīng)速度上,PinchBench(專為AI編程工具設(shè)計(jì)的測(cè)評(píng)榜單)顯示,國(guó)產(chǎn)模型除千問外,其余主要模型的速度排名均較為靠后。Kimi K2.5位于第20名,MiniMax M2.1是第23名。速度,對(duì)開發(fā)者來說是實(shí)實(shí)在在的體驗(yàn)差距,而非可以忽視的參數(shù)。
漲價(jià)潮打斷了調(diào)用量增長(zhǎng),這才是更深層的變化
這輪調(diào)用量集體下滑,還有一個(gè)不容忽視的背景:算力漲價(jià)。
有媒體報(bào)道將這場(chǎng)逆轉(zhuǎn)與"一輪席卷全球的算力漲價(jià)潮高度吻合"直接掛鉤。在連續(xù)十周爆發(fā)式增長(zhǎng)之后,全球AI大模型總調(diào)用量連續(xù)兩周走低,從高峰期的27萬億Token回落至20.6萬億Token。
這個(gè)節(jié)點(diǎn)的出現(xiàn)有其必然性。免費(fèi)額度驅(qū)動(dòng)的調(diào)用量天花板已經(jīng)觸及,接下來要跑的,是真實(shí)付費(fèi)意愿支撐的持續(xù)增長(zhǎng)。智譜在GLM-5.1發(fā)布時(shí)已經(jīng)以行動(dòng)表態(tài):定價(jià)提升10%,編碼場(chǎng)景價(jià)格首次追平Anthropic。這是國(guó)產(chǎn)大模型第一次主動(dòng)走出"低價(jià)換量"的路徑。
智譜CEO張鵬此前解釋得直接:"完成一個(gè)長(zhǎng)程任務(wù)所需要的Token量可能是回答一個(gè)簡(jiǎn)單問題時(shí)的十倍甚至百倍,價(jià)格調(diào)整本質(zhì)上是價(jià)值變化的自然結(jié)果。"
一季度智譜API調(diào)用定價(jià)提升83%,調(diào)用量卻增長(zhǎng)400%——這組數(shù)據(jù)說明,真正的市場(chǎng)需求遠(yuǎn)比免費(fèi)量體現(xiàn)得更扎實(shí)。
調(diào)用量之外,中國(guó)AI還有一盤更大的棋
單看OpenRouter的周榜,容易陷入"你追我趕"的短視邏輯。但中國(guó)AI的另一條戰(zhàn)線,正在悄悄取得更結(jié)構(gòu)性的進(jìn)展。
新加坡政府重金打造的國(guó)家級(jí)大模型項(xiàng)目SEA-LION,2025年11月宣布棄用Meta的Llama架構(gòu),改用阿里通義千問作為新版旗艦基座模型。在最新的東南亞語言模型榜單上,千問在印尼語、馬來語、泰語、越南語等排行榜上高居榜首。
這背后的邏輯,跟調(diào)用量排行榜無關(guān)。東南亞有超過1200種本地語言,西方模型在預(yù)訓(xùn)練階段的東南亞語言詞元覆蓋嚴(yán)重不足——鬧出過把委內(nèi)瑞拉列為東盟成員國(guó)這類低級(jí)錯(cuò)誤。千問以36萬億預(yù)訓(xùn)練詞元、覆蓋119種語言的規(guī)模,成為了這個(gè)場(chǎng)景下真正好用的選擇。
這是"調(diào)用量"數(shù)字背后更難被直接觀測(cè)到的東西:中國(guó)模型正在通過語言覆蓋和開源策略,在全球范圍內(nèi)建立更廣泛的基礎(chǔ)設(shè)施級(jí)存在。
連漲十周之后的一次下跌,既不意味著"中國(guó)AI見頂",也不能掩蓋真實(shí)存在的結(jié)構(gòu)性短板——尤其是在編程這個(gè)對(duì)開發(fā)者來說最關(guān)鍵的場(chǎng)景。調(diào)用量的數(shù)字會(huì)繼續(xù)波動(dòng),但競(jìng)爭(zhēng)的底層邏輯正在變得越來越清晰:誰能在真實(shí)付費(fèi)場(chǎng)景中贏得持續(xù)信任,誰才算站穩(wěn)了。
這個(gè)答案,不會(huì)在周榜里讀出來,需要往后再看幾個(gè)月。
本文來自至頂AI實(shí)驗(yàn)室,一個(gè)專注于對(duì)AI計(jì)算機(jī)、工作站及各類AI相關(guān)硬件設(shè)備,開展基于真實(shí)使用場(chǎng)景評(píng)測(cè)的研究機(jī)構(gòu)。
Q&A
Q1:中國(guó)大模型調(diào)用量這次為什么被美國(guó)反超?
直接原因是Claude Sonnet和Opus在編程場(chǎng)景強(qiáng)勢(shì)回升,拉動(dòng)美國(guó)模型整體增長(zhǎng)。同期國(guó)產(chǎn)模型在Coding領(lǐng)域的產(chǎn)品力尚不足以穩(wěn)住開發(fā)者,加上此前依靠免費(fèi)額度驅(qū)動(dòng)的調(diào)用量增長(zhǎng)觸及天花板,導(dǎo)致兩個(gè)方向同時(shí)收縮。
Q2:之前中國(guó)模型連續(xù)超越美國(guó),是真實(shí)領(lǐng)先還是泡沫?
兩者都有。MiniMax、DeepSeek、千問等模型在長(zhǎng)上下文處理和性價(jià)比上的優(yōu)勢(shì)是真實(shí)的,全球開發(fā)者的認(rèn)可也是真實(shí)的。但免費(fèi)額度驅(qū)動(dòng)的調(diào)用量峰值,確實(shí)夸大了短期數(shù)字,掩蓋了在Coding等關(guān)鍵場(chǎng)景上仍然存在的差距。
Q3:中國(guó)AI的真正優(yōu)勢(shì)和劣勢(shì)分別在哪里?
優(yōu)勢(shì)在于:超長(zhǎng)上下文處理能力、開源生態(tài)滲透、多語言覆蓋、性價(jià)比,以及在東南亞等新興市場(chǎng)的基礎(chǔ)設(shè)施級(jí)布局。劣勢(shì)在于:編程場(chǎng)景的產(chǎn)品力和開發(fā)者信任積累不足,響應(yīng)速度與頂級(jí)閉源模型仍有差距,高強(qiáng)度持續(xù)付費(fèi)場(chǎng)景的用戶粘性有待驗(yàn)證。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.