![]()
產(chǎn)業(yè)競爭的烈火終究是燒到了大模型上,前段時間,知名編程模型Claude的開發(fā)商、估值超過3500億美元(約合25000億人民幣)的Anthropic公司選擇對華“斷供”。而且不僅是對中國企業(yè),也明確指出包含中國公司持股的海外企業(yè)。
國內(nèi)企業(yè)陸續(xù)被暫停了Claude API使用,紛紛尋找替代品。包括字節(jié)跳動的TRAE和騰訊的CodeBuddy等編程平臺的國內(nèi)版,也被迫下架Claude模型,一時間風(fēng)聲鶴唳。
在大模型百花齊放的今天,Claude斷供中國真的如此關(guān)鍵嗎?答案是肯定的。
Claude之所以難以被替代,源于其深厚的技術(shù)積淀。在復(fù)雜算法實現(xiàn)和系統(tǒng)架構(gòu)設(shè)計等高級編程任務(wù)中,Claude有更高的完成度,跨越了編程領(lǐng)域“可信”和“可靠”的心理閾值。
然而,機(jī)遇往往與危機(jī)并存。
![]()
1月底,一家中國大模型公司發(fā)布的新開源模型,因為突出的編程性能和視覺理解能力,引發(fā)了海內(nèi)外技術(shù)社區(qū)和開發(fā)者的廣泛關(guān)注。
連續(xù)一周登上Twitter科技新聞熱搜,僅僅三四天時間,官方發(fā)布帖子的閱讀量就達(dá)到了 680萬,甚至不亞于美國OpenAI和Anthropic的旗艦?zāi)P桶l(fā)布帖子。頂尖AI技術(shù)領(lǐng)袖,160萬粉絲的前特斯拉AI總監(jiān)Andrej Karpathy、卡內(nèi)基梅隆大學(xué)教授Tim Dettmers等專家也點贊恭喜。
![]()
從AI行業(yè)權(quán)威的評測機(jī)構(gòu)LMarena(大模型匿名競技場)代碼能力基準(zhǔn)測試中,這個名為Kimi K2.5的中國模型,排在全球開源模型的第一位,僅次于Claude和谷歌Gemini最新的旗艦?zāi)P汀T谇?0名的榜單中,也是唯一的中國模型。
![]()
美國大模型技術(shù)最好的三家公司:OpenAI、Claude和Gemini,因為旗下模型的性能和實際表現(xiàn)總在排行榜的前列,通常被行業(yè)稱為美國“御三家”。
這是第一次,中國公司通過開源模型打破了美國“御三家”的編程和視覺理解技術(shù)壟斷。
美國另一家權(quán)威評測機(jī)構(gòu)Artificial Analysis和中國模型基準(zhǔn)測試機(jī)構(gòu)SuperCLUE的分析都顯示,Kimi K2.5模型的智能水平是全球開源第一,僅次于閉源的美國“御三家”。
在特別注重編程性能的AI領(lǐng)域,但凡有一款大模型做到關(guān)鍵指標(biāo)領(lǐng)先,就會被迅速推開。
Kimi K2.5一經(jīng)推出后,海外知名編程工具Kilo Code就迅速接入,并宣布首周免費來吸引用戶。國內(nèi),騰訊旗下編程工具CodeBuddy、字節(jié)跳動旗下編程工具TRAE也第一時間上架,因為突出的編程能力,和同時支持視覺的完備性,立即成為首選國產(chǎn)模型。
![]()
而發(fā)布Kimi K2.5模型的這家中國創(chuàng)業(yè)公司,卻有個略顯“中二”的名字,叫月之暗面。2025年底,他們剛剛完成了C輪35億元的融資,公司總估值在350億左右。僅為Anthropic 2.5萬億的1/70。
![]()
和很多工業(yè)軟件一樣,在編程大模型領(lǐng)域,中國的業(yè)界曾經(jīng)也處于被卡脖子的狀態(tài)。
據(jù)行業(yè)評測數(shù)據(jù)顯示,Claude在復(fù)雜算法實現(xiàn)、系統(tǒng)架構(gòu)設(shè)計等高級編程任務(wù)中的完成度顯著高于行業(yè)平均水平。在市場生態(tài)方面,Claude也因為先發(fā)優(yōu)勢,構(gòu)建了完整的開發(fā)者服務(wù)體系,形成了顯著的用戶粘性,特別是大型企業(yè)用戶的年均續(xù)約率更高。
也正是基于這些優(yōu)勢,Claude的相關(guān)模型價格高了國內(nèi)5-7倍。
那么貴,為什么不用國產(chǎn)?
不得不承認(rèn),在這個中國模型亮相之前,國產(chǎn)編程模型存在明顯的技術(shù)差距。
首先是模型的智能水平,海外模型基本都是萬億參數(shù)起步,才能做到對廣泛任務(wù)和高難度任務(wù)的較好應(yīng)對。中國主要是幾千億參數(shù)的模型,難以應(yīng)對較為復(fù)雜的任務(wù),只能做一些非常簡單的編程工作。
然后是,中國主流模型在架構(gòu)設(shè)計上普遍采用純文本預(yù)訓(xùn)練,缺乏視覺模塊的整體集成。這意味著模型無法理解圖像包含的語義信息,在需要多模態(tài)理解的場景中表現(xiàn)受限。
比如在前端開發(fā)領(lǐng)域。某大型電商平臺技術(shù)團(tuán)隊曾進(jìn)行對比測試:當(dāng)要求模型根據(jù)UI設(shè)計稿生成前端代碼時,必須有很強(qiáng)視覺能力,才能準(zhǔn)確識別設(shè)計稿中的布局關(guān)系、色彩體系和交互元素。
視覺理解能力的技術(shù)門檻主要體現(xiàn)在三個層面:首先是視覺信號編碼,需要將像素信息轉(zhuǎn)化為有意義的特征表示;其次是跨模態(tài)對齊,要求模型理解視覺內(nèi)容與文本描述之間的關(guān)聯(lián);最后是統(tǒng)一表示學(xué)習(xí),需要建立共享的語義空間。
這些技術(shù)難題如同幾座大山,阻礙了國產(chǎn)編程模型的進(jìn)階之路。
而在實際應(yīng)用中,這種技術(shù)差距直接影響了開發(fā)效率。開發(fā)效率的差距進(jìn)一步影響了產(chǎn)品的迭代速度,這在快速變化的市場環(huán)境中是致命的。
大模型不同于新能源汽車,要想超車,沒有技術(shù)以外的捷徑可走。
面對技術(shù)壁壘,中國公司選擇對大模型的底層架構(gòu)進(jìn)行革新。
比如Kimi K2.5采用了原生多模態(tài)架構(gòu),通過ViT+Transformer的混合編碼器實現(xiàn)圖像和文本的聯(lián)合表示,在模型底層實現(xiàn)了信號融合。
這種設(shè)計相比傳統(tǒng)的后期融合方法,在語義保持度和計算效率上具有顯著優(yōu)勢,具體而言,模型在訓(xùn)練過程中就建立了視覺與文本的深度關(guān)聯(lián),而非簡單地將兩個獨立的模型輸出進(jìn)行拼接。
此外,據(jù)了解,在Kimi K2.5模型的開發(fā)中,這家公司還重點優(yōu)化了訓(xùn)練基礎(chǔ)設(shè)施,通過重構(gòu)強(qiáng)化學(xué)習(xí)框架,讓訓(xùn)練效率提升數(shù)倍。
而在視覺理解能力的痛點上,Kimi K2.5更是實現(xiàn)了對Claude的反超:在界面設(shè)計稿轉(zhuǎn)代碼任務(wù)中,Kimi K2.5可準(zhǔn)確識別組件的空間關(guān)系、樣式屬性和交互邏輯,代碼生成準(zhǔn)確率超過Claude。
更為友好的是Kimi K2.5的定價:API調(diào)用的輸入價格為4元/百萬Token,僅為Claude中號模型Sonnet 4.5的1/5,大號模型 Opus 4.5 的1/8。
對于那些每年在大模型上砸數(shù)千萬元的互聯(lián)網(wǎng)企業(yè)而言,終于等到了一個全功能的、代碼和視覺能力都很強(qiáng)的Claude中國平替模型。
![]()
當(dāng)然,一個大模型好不好用,性能到底受不受認(rèn)可,最終都是市場來說話。
OpenRouter數(shù)據(jù)顯示,Kimi K2.5上線第二天即進(jìn)入日活躍度前三。
![]()
全球最大、估值超千億的AI搜索創(chuàng)業(yè)公司Perplexity,第一時間上架了Kimi K2.5模型,作為給付費用戶的高級模型使用。在Perplexity平臺上,這也是唯一的中國模型。
![]()
從全球開發(fā)者的實際反饋來看,這個名為Kimi K2.5的模型,編程能力的表現(xiàn)非常突出, “可以挑戰(zhàn)Claude的中號模型Sonnet 4.5,略遜于大號模型Opus 4.5”,同時價格只有他們的1/5到1/8,性價比優(yōu)勢突出。
知名編程工具Cline的開發(fā)專家Juan Pa發(fā)帖稱,他在一項實際編程任務(wù)中測試了Codex 5.2、Opus 4.5 和 Kimi K2.5三個模型,他的測試結(jié)果是“Kimi K2.5以38%的成本達(dá)到了約Opus 90%的質(zhì)量。”
![]()
人工智能專家Mariusz Kurman則建議,“在項目計劃階段使用Opus4.5模型,在創(chuàng)建階段使用Kimi K2.5模型,可以達(dá)到最佳效果。”
![]()
在國內(nèi)技術(shù)社區(qū)上,開發(fā)者們實測之后反饋稱,“Kimi K2.5多模態(tài)能力以及coding能力還可以的,作為Gemini Pro。Claude和GPT5.2 codex模型的替代也是不錯的。國產(chǎn)模型越來越好了。”
![]()
一直以來,很多人都以為在AI競賽上,美國企業(yè)主導(dǎo)基礎(chǔ)模型層,而中國企業(yè)只是擅長應(yīng)用開發(fā)。
2025年初,DeepSeek的出現(xiàn)打破了這種判斷。2026年初,這家叫月之暗面的公司推出的新模型,則在編程這個關(guān)鍵領(lǐng)域再次突破了美國模型的壟斷。
事實上,這家公司并不是2026年初才橫空出世的。早在2025年中,他們就因為首個萬億參數(shù)的開源模型K2受到了國際社會的關(guān)注,被英國自然雜志稱為中國的另一個DeepSeek時刻。
而在硅谷廣受歡迎的All-In Podcast中,Kimi K2.5也被直接定義為“開源AI的重要里程碑”。
![]()
硅谷知名的風(fēng)險投資家、企業(yè)家Chamath Palihapitiya將Kimi K2.5的發(fā)布和帶來的反響概括為“Kimi K2.5時刻”。
作為一位曾參加白宮科技圓桌會議并采訪過美國總統(tǒng)的權(quán)威人士,Chamath認(rèn)為,開閉源已不只是技術(shù)路線之爭,而是企業(yè)、組織乃至國家層面的“基礎(chǔ)設(shè)施選擇”。
由此可見,我們需要更多的DeepSeek時刻,需要看到更多中國力量的突破,不是一個DeepSeek,而是一大批DeepSeek。特別是在地緣政治不確定性的背景下,本土模型更是中國企業(yè)的剛需,因為在核心系統(tǒng)中采用自主可控的AI技術(shù),既是商業(yè)選擇,也是戰(zhàn)略必須。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.