作者I山上 薛星星
像所有 AI 行業(yè)人士一樣,月之暗面創(chuàng)始人楊植麟喜歡用"AI 一天,人間一年"的說法形容 AI 的迅速迭代。對于剛剛發(fā)布的 Kimi K3 而言,似乎沒有什么形容比這句話更為貼切。月之暗面成立至今已有三年,但過去三年的所有積累可能都抵不上這三天的轟動。
自 ChatGPT 發(fā)布以來,中國 AI 行業(yè)有許多次震驚世界的時刻。一部分來自于真正的技術突破,一部分則是媒體與廠商們的自嗨,Kimi K3 的發(fā)布似乎是唯一能與"DeepSeek 時刻"相媲美的。
和去年年初 DeepSeek-R1 發(fā)布后美國芯片產(chǎn)業(yè)普跌類似,上周包括英偉達、博通以及美光在內的費城半導體指數(shù)重挫 10%,創(chuàng)下自 2025 年 4 月以來最大單周跌幅,進入技術性熊市區(qū)間。媒體統(tǒng)計稱,72 小時內美股 AI 板塊合計蒸發(fā) 4700 億美元,約超 3 萬億人民幣。
不止一家海外媒體及研究機構用諸如"DeepSeek 2.0"來形容 Kimi K3。《財富》雜志稱這是"第二次 DeepSeek 沖擊",《華爾街日報》強調 Kimi 加劇了華爾街芯片股拋售,彭博社則表示"Kimi 顛覆了美國領先中國的傳統(tǒng)認知"。
恐慌的情緒不斷蔓延,甚至令 OpenAI 及 Anthropic 都備受質疑,因為一家中國開源模型的性能似乎已接近頂級閉源模型。二者本就處在上市前的關鍵節(jié)點,模型性能領先是他們獲得高估值以及高定價的關鍵。部分美國開發(fā)者已經(jīng)在質疑為何還要為 Claude 和 GPT 付出這么多的價格。
過去幾日,Anthropic 宣布為所有 Max 及 Team Premium 用戶開放 Claude Fable 5,但限額 50%,此前他們曾因算力問題而計劃完全從訂閱方案中移除這一模型。OpenAI 則在上周多次重置 Codex 限額,甚至一度取消了 5 小時的用量限制。
很難說這些事件都是 Kimi K3 的沖擊所致。在此之前,半導體產(chǎn)業(yè)已經(jīng)連續(xù)承壓數(shù)周,華爾街分析師們迫切需要為這輪下跌尋找一個足夠醒目、也容易理解的借口——境外勢力自然是萬能法寶。更不用說 OpenAI 及 Anthropic 本就處在激烈競爭之中,已經(jīng)演變到大打價格戰(zhàn)的地步。
但這似乎并不影響美國科技行業(yè)對于 Kimi K3 的驚訝。即便 Kimi 承認自身總體性能仍落后于 Claude Fable 5 于 GPT-5.6 Sol,諸多海外評測機構仍在測評對 K3 不吝贊美,排名往往位列前茅。
Arena.ai 稱 Kimi K3 以 1679 分的成績獲得前端代碼競技場榜首,超越 Claude Fable 5。這家機構表示,上次中國模型如此接近領先,還是 2025 年的 DeepSeek-R1。
高昂的市場熱情下,連楊植麟都成為美國科技圈熱議的新偶像人物。大洋彼岸的人民群眾疑問為何他當年沒有留在美國,而是回到了中國。楊植麟的博士生導師不得不專門發(fā)文解釋,澄清楊回國并不是由于簽證或移民問題,而是他自己堅定要回去創(chuàng)業(yè)。
大模型行業(yè)仍然遵循著最簡單明了的優(yōu)勝劣汰法則,只要性能足夠領先,價格就不是問題。即便 K3 模型的輸入及輸出價格均較上代 K2.6 模型均上漲超 3 倍有余,也顯著高于 GLM-5.2 及 DeepSeek V4 Pro,已經(jīng)是目前市面上最貴的國產(chǎn)模型,但 Kimi 依然遭遇了算力緊缺問題。
7 月 19 日晚,Kimi 宣布由于算力緊缺,自即日起暫停 C 端新用戶訂閱。他們同時調整了會員權益,將原本覆蓋 Kimi 網(wǎng)頁版、App 以及 Kimi Work 的通用會員與 Kimi Code 會員拆分銷售。Kimi 總裁張予彤稱,K3 發(fā)布次日公司 ARR 創(chuàng)下歷史最大單日增幅。
算力緊缺一定程度上或許也與 K3 模型自身的 Token 效率相關。在 Artificial Analysis 的評測中,K3 完成整套測試輸出了 1.3 億個 Token,接近同類模型平均水平的兩倍。更長的輸出通常意味著更高的推理成本,這可能進一步加重 Kimi 的算力壓力。
社交媒體上,也有不少開發(fā)者吐槽 Kimi K3 是 Token 消耗大戶,有人稱跑了 15 分鐘就已經(jīng)耗盡了 5 小時的限額。
K3 的出圈似乎再一次證明了 AI 時代模型的脆弱性。僅僅兩周之前,中國大模型市場最被人看好的還是已經(jīng)上市的智譜。上半年智譜發(fā)布的 GLM-5.2 模型被譽為國產(chǎn)開源模型的驕傲,幾次大幅上調價格依然緊俏。上市半年來,智譜股價翻了 24 倍有余,總市值一度突破 1.3 萬億港元。
但從上周開始,智譜的神話似乎就已松動。上周五,智譜股價下跌 28.49%,本周一再跌 19.56%,兩個交易日股價累計下跌超 4 成,市值跌破 5000 億港元。
Kimi K3 的領先可能也維持不了多久。7 月 19 日,阿里巴巴發(fā)布 Qwen3.8 Max 預覽版,參數(shù)規(guī)模達 2.4 萬億,宣稱綜合能力在全球范圍內僅次于 Claude Fable 5。馬斯克對外稱,擁有 2 萬億參數(shù)量的 Grok 新模型即將完成初步訓練,它可能在保持較高運行效率的同時超越 Kimi。
K3 發(fā)布當天,薩姆·奧爾特曼對外表示,他知道他們過去 12 個月并非最佳,這主要歸咎于他,但他們即將迎來迄今為止最好的 12 個月。"團隊正在做非常出色的工作,我相信你會對他們?yōu)槟銣蕚涞捏@喜感到非常滿意。"
芯片行業(yè)多年來一直奉行著摩爾定律,在成本大致不變的情況下芯片性能大約每 18 至 24 個月翻一倍。但就像 AI 行業(yè)人士常常掛在嘴邊的"AI 一天,人間一年"的說法,AI 時代的模型性能提升可能以周甚至天來計算。
去年谷歌的 Gemini 模型一度令薩姆·奧爾特曼在公司內拉響紅色警報,但現(xiàn)在 Gemini 更流行的稱謂是"北美豆包"。彭博社稱 Gemini 3.5 Pro 的發(fā)布時間已經(jīng)推遲數(shù)月,因為模型在編程及代碼生成能力上未達預期。
兩個交易日的重挫后,市場消息稱智譜可能跳過 GLM-5.3,直接推出 GLM-5.5,預計最快將于 8 月發(fā)布,據(jù)稱將具備萬億以上的參數(shù)規(guī)模。智譜的員工們已經(jīng)開始在推特上放出小道消息,稱現(xiàn)在可能是訂閱 GLM Coding Plan 的最佳時機。
剛剛完成首輪融資的 DeepSeek 被曝即將推出 DeepSeek-V4 模型的正式版,外界稱性能將逼近 GPT-5.6,且繼續(xù)保持極高性價比的優(yōu)勢。
過去的時代總在反復證明時間的重要。無論是 PC 互聯(lián)網(wǎng)還是移動互聯(lián)網(wǎng),一家公司只要起步足夠早、跑得足夠快,就有機會趕在窗口關閉前建立先發(fā)優(yōu)勢。而隨著用戶和市場規(guī)模不斷擴大,領先非但不會被稀釋,反而會持續(xù)放大,令后來者越來越難以追趕。
但在 AI 時代,優(yōu)勢并不總是站在時間這一邊。所有的領先都建立在模型性能的迭代上,總有后來者不斷推出更新的模型,縮短與前者的差距。如果說互聯(lián)網(wǎng)時代最難追趕的是規(guī)模,那么 AI 最醒目的優(yōu)勢就是模型。只是這種優(yōu)勢的保質期,往往只有一個版本。
兩個交易日內股價連跌 4 成的智譜,今日盤中漲幅一度超 35%。市場消息稱,智譜已落地 1GW 級國產(chǎn) AI 算力數(shù)據(jù)中心建設。
競爭仍在繼續(xù)。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.