今年這個七月,大模型圈比三伏天還熱鬧。
7月19日,月之暗面緊急暫停C端新用戶訂閱,優先保障存量用戶體驗。
剛登頂全球代碼評測榜、被稱作“中國Fable 5時刻”的Kimi K3大模型,發布僅三天就因用戶量暴漲觸發算力告急。
![]()
Kimi K3 于7月16日正式發布,總參數規模沖到 2.8 萬億,是目前全球參數最大的開源模型,全系標配 100 萬 token 上下文窗口,還原生支持多模態視覺理解。技術上搭載 KDA 混合線性注意力機制,靠稀疏專家框架控制推理成本。
官方表態,它的綜合能力仍落后于 Claude Fable 5 與 GPT-5.6 Sol,但已經能穩定領先其余主流大模型。
Kimi剛把參數門檻拉到新高度,阿里千問立刻接棒沖榜。
7月19日,通義實驗室放出千問 Qwen3.8 預覽版,總參數 2.4 萬億,架構升級為動態稀疏自適應門控。正式版擬近期開源。千問團隊給它的定位為性能僅次于 Fable 5,屬于當今最強模型之列。
![]()
和前兩家死磕性能參數的路子不同,DeepSeek 依然焊死“性價比卷王” 的標簽。
DeepSeek V4 預覽版早在今年4月便已上線并同步開源,有行業人士預測正式版最早會在7月20日全量落地,V4 分為 Pro 與 Flash 兩個版本,旗艦版 V4-Pro 參數 1.6 萬億,全系列支持 100 萬 token 超長上下文。
![]()
官方實測數據顯示,正式版推理計算量僅為前代 V3.2 的 27%,顯存占用降至前代的 10%。商業玩法更激進,在國內大模型行業率先推出峰谷分時定價,平峰時段 API 價格僅為海外同級閉源模型的約七分之一,把成本優勢拉到了極致。
各家說得再熱鬧,不如檢驗模型的真實性能成色。
從7月中旬更新的 LMArena 綜合榜單來看,Anthropic 的 Claude Fable 5 穩居 ELO 積分榜首,前五名均被海外閉源模型包攬;當時國產陣營里排名最高的 Qwen3.7-Max 處于全球中上游位次,但和第一梯隊還有明顯差距。
但三款新模型陸續落地后,這個差距正在快速縮小,部分賽道甚至實現反超。
第三方機構 Artificial Analysis 的數據顯示,Kimi K3 在 Frontend Code Arena 前端代碼競技場拿到 1679 分,直接登頂全球第一,性能超過 Claude Fable 5;綜合智能指數得分57,成功躋身全球第一梯隊。而根據千問團隊的內部測試結果,Qwen3.8 的編碼能力與 Fable 5 的差距縮小至 12.6分,在協同智能體任務上的表現已超越 Claude Opus 4.8 Max。
![]()
國產大模型正在不斷提高研發節奏,利用開源開放 + 極致性價比的組合打法,慢慢撬動全球 AI 產業的既有格局。等三款新模型的完整第三方評測全部出爐,全球大模型的座次表,大概率還會迎來新一輪調整。
來源:星河商業觀察
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.