![]()
來源 | Tech星球
文| 林京 王琳
7月19日傍晚,在Kimi K3炸榜2天后,阿里云發布了Qwen3.8-Max預覽版。它是個“半成品”,而且承諾以天為單位持續進化,旗艦級模型以“預覽版+日更模式”亮相。
相比于Kimi K3的定價創新高,Qwen3.8預覽版期間以“骨折價”開路:白天調用僅需1折,夜間低至0.2折。一些用戶發現,模型似乎每天都比前一天聰明些。但也有一些用戶表示,付費了是實打實要干活的,不是感受不穩定模型的。
Qwen3系列,是林俊旸在職期間主導的大模型,Qwen3.5是林俊旸離開前發布的最后一個版本。但該版本相比去年9月曾進入大模型盲測榜單LMArena前三的Qwen3-Max Preview,落差明顯,據《晚點LatePost》報道,阿里內部有高管對這款除夕夜發布的模型并不滿意,甚至稱之為 “半成品” 。
林俊旸堅持開源,后因阿里組織架構調整離開,業界曾掀起了巨大的討論。Qwen系列模型能力是否可以持續進化,成為外界非常關注的問題。
從參數來看,Qwen3.8-Max總參數量達到2.4萬億,采用MoE架構,是阿里首次突破萬億參數的原生多模態模型。官方數據顯示,在代碼和協同辦公兩大核心場景中,預覽版較前代Qwen3.7-Max分別提升了22.8%和44.4%。
在林俊旸離開后140天,Qwen3.8-Max將重回開源路線。阿里或許終于明白,在模型能力離閉源頭部仍有一定差距時,開源是企業維護口碑和生態的最佳選擇。
日更版本Qwen3.8-Max預覽版,沒有宣傳中好
據官方介紹,相較于上一代旗艦模型Qwen3.7-Max,新模型在代碼工程、專業辦公等核心能力上實現顯著提升,在全棧開發、數據分析、Office 辦公工作流等復雜長程任務中展現出全球領先的綜合能力,并仍在持續進化中。
為了測試Qwen3.8-Max預覽版在辦公場景下的表現,我們給了他一份題為《具身智能發展報告(2025年)》,要求其回答以下三個問題:報告中列舉了哪幾種主要的具身智能技術實現路徑,請分別簡要說明其核心特點?根據報告中的數據,分析2025年具身智能領域的投融資呈現哪些特征?根據報告中的數據,設計3-5個最適合做PPT圖表的數據可視化方案。
![]()
![]()
![]()
這三個問題,Qwen3.8-Max預覽版都經過10秒左右時間的思考,都能給出清晰的答案,并輔以表格進行展示。
在X平臺上,一位名叫“Lonely”的獨立開發者使用Qwen 3.8-Max 預覽版生成了一個及其驚艷的視頻,第一次他只給了模糊需求,導致生成的效果平庸且缺乏創意。第二次他清晰列出了功能模塊、交互邏輯、圖像規則和頁面結構。
![]()
最終生成的昆蟲效果和BBC紀錄片里拍攝到的一樣,非常寫實。對比第一版動漫效果,網站專業性更強。同時,每一個昆蟲都有學習卡片,還可以自測學習進度。
體驗下來后,他發現Qwen 3.8 Max 預覽版即使面對超長提示和多頁面構建,整個生成過程依然流暢,僅耗時17分鐘,Kimi K3需要52分鐘,等待時間大大縮短。在長任務執行時,Qwen 3.8 Max 預覽版表現優異,最終產品基本實現了添加的交互細節和模塊分解。
為了測試Qwen3.8-Max的前端生成能力,我要求它生成一個宇宙星系介紹的交互式HTML頁面,具體要求如下:
![]()
![]()
表面看上去,模型滿足了我們的基本要求,但是存在常識性錯誤:主要行星圍繞太陽公轉的速度一樣,他們的相對位置也沒有變化。可事實上,他們的相對位置一直在變化,公轉速度也完全不一樣。
從社交平臺上用戶反饋來看,Qwen3.8-Max預覽版在創意編程、3D交互、復雜敘事等非標準化任務上仍有明顯不足。更有人將Qwen3.8-Max形容為“裸奔式發布”——有參數沒數據,有口號沒證據,阿里選擇用“日更”和“限時一折”的組合拳,換取大規模真實用戶反饋,完成最后的打磨。這也與阿里此前發布的視頻生成模型HappyHorse時的策略幾乎一致,先把熱度拉滿,能力后續慢慢跟上,用市場關注度為產品迭代爭取窗口期。
不過,參考騰訊混元hy3正式版相較于preview版本的提升幅度,Qwen3.8正式版本實力或會進一步提升。
一位獨立游戲開發者向Tech星球分享了他的使用體驗,他日常基于Godot引擎與Blender進行游戲原型開發,工作流對響應速度與迭代效率有較高要求。從實際使用來看,Qwen3.8-Max預覽版在復雜邏輯生成與長上下文任務中的表現尚未進入第一梯隊,但其在短周期、高頻次交互場景下的單位時間產出效率甚至優于GPT-5.6 Sol,性價比確實能打。不過,當任務周期拉長到30分鐘級別的連續推理或大規模代碼生成時,Qwen3.8-Max預覽版的后勁明顯不足,穩定性還差口氣。
在具體能力維度上,他評估認為,當前在游戲功能代碼生成與基于MCP協議的工具調用控制方面,GPT-5.6 Sol處于明確的第一梯隊;Kimi K3與GLM 5.2可歸入第二梯隊;Qwen3.8-Max預覽版則需再降一檔,其核心競爭點更多集中于上下文窗口容量、單位調用成本及響應延遲方面的綜合平衡,適合高頻輔助開發場景,但在復雜任務精度與深度上仍存在明顯短板。
比起大模型本身,“限時一折”的價格,讓不少開發者在自身使用的主力大模型之外,選擇Qwen系列,一位開發者就向Tech星球表示,他是在Kimi K3月額度用完后才臨時切到Qwen系列,才知道有了最新版本,大模型迭代速度非常快,遇到新版本都想嘗試下,但如果Qwen3.8恢復原價,不一定會繼續使用。
阿里為何著急端上Qwen3.8-Max?
林俊旸離開之后,阿里大模型團隊進入了一個微妙的調整期。
林俊旸離開之后的一周之內,阿里在今年3月30日至4月2日間連續發布三款模型,Qwen3.5-Omni、Wan2.7-Image和Qwen3.6-Plus。不同的是,三款模型全部閉源,開發者無法下載權重進行本地部署,只能通過阿里云百煉平臺調用API,這與Qwen系列過去兩年“開源優先”的傳統形成了鮮明對比。
但從大模型發布節奏來看,在 2025年底到 2026年中這半年里,Claude、Gemini、Llama 全都在熱火朝天地推“4系”甚至“4.5系”旗艦。而 Qwen 在這段時間內的主要大版本號依然停留在 Qwen3,更新節奏相對克制。
過去一年,阿里并沒有推出像 Qwen4 這樣的“跨代”基座版本,主要集中在推理性能的微調和長文本能力的優化,部分能力融入到了小規模版本中。相比之下, Claude一年內完成了從 3.5 到 4.0 再到 4.5 的跨越,速度非常驚人。Gemini 過去一年發布了 1.5 改進版、2.0、2.5 三代,迭代密度極高,幾乎是平均 3-4 個月一個大版本。Llama 不到一年時間,從 3.3 跨越到了 4.1,且始終保持開源,節奏極快。
![]()
阿里2026財年(截至2026年3月31日)年報及第四季度財報,首次交出了一份可量化的AI商業化成績單。本季度,阿里AI相關產品在阿里云外部收入中的占比首次突破30%,達到89.71億元,年化經常性收入(ARR)已超過358億元——其中,絕大部分來自百煉MaaS平臺的API服務收入,也就是企業客戶為調用模型支付的Token費用。
阿里集團CEO吳泳銘反復在財報電話會上強調一個判斷,AI已經跨越初期投入,進入商業化回報周期。面向未來五年,阿里AI基建投入資金會遠超此前承諾的三年3800億元。
巨額投入的成本壓力,決定了阿里必須在AI商業化上找到確定性的大規模收入來源,而不只是停留在技術聲量和開源口碑層面。而當“賣Token”成為最大收入來源時,一個結構性矛盾隨之浮現,開源旗艦模型本質上是在API付費墻之外,為自己搭建了一個免費替代品,每一個能夠本地部署Qwen的開發者,都天然減少了調用付費API的需求。換言之,阿里越擁抱開源生態,就越可能在商業化變現的道路上,親手為自己培養競爭對手。
也因此,阿里大模型閉源邊界持續擴大,“中小模型開源、大模型閉源”的雙軌模式逐步成型。
但市場并沒有給阿里的大模型調整留下太多時間,進入7月,全球AI大模型進入密集發布窗口期,頭部玩家們幾乎同步亮出新牌。
7月16日,月之暗面發布了擁有2.8萬億參數的Kimi K3,主打長程編程與復雜推理,多項代碼評測指標反超GPT-5.6 Sol。DeepSeek V4也在同期推進,以極致性價比策略切入市場,競爭維度從單一能力向性能、成本、迭代效率的多維博弈轉變。
海外同樣在7月迎來“AI大亂斗”。7月9日,OpenAI正式發布GPT-5.6系列(旗艦版Sol等),編碼能力再創新高;xAI推出Grok 4.5,主打性價比;Meta發布Muse Spark 1.1,強化工具調用。同時,谷歌Gemini 3.5 Pro也計劃在7月中旬上線。海外發布高度聚焦編碼、工具調用和AI Agent能力。
當大模型進入到按周迭代的競速,在Kimi K3和DeepSeek V4雙重壓力下,阿里必須搶跑。在Kimi K3發布僅3天后,阿里迅速推出Qwen3.8-Max預覽版,被外界視為搶占窗口期的關鍵動作,以及在全球AI競賽中保持聲量的關鍵動作。
為了搶這個窗口,Qwen3.8-Max的發布形式也帶著多重“趕時間”的痕跡:后訓練尚未收尾,在對外宣傳上,英文版直接宣稱“僅次于Fable 5”,但中文版卻加上了“可能”二字。并且,明確承諾開源,這也是阿里旗艦版大模型再次回歸開源策略。
林俊旸離開之后,Qwen3.8-Max再度回歸開源?
林俊旸離開之后,通義實驗室經過三次組織架構調整。
3月阿里成立ATH事業群(Alibaba Token Hub),將AI相關業務收攏至統一框架,由吳泳銘親自帶隊,確立“Token生產、分發和變現”的核心戰略。4月,設立集團技術委員會,吳泳銘任組長、周靖人任首席AI架構師,同時將通義實驗室升級為通義大模型事業部。6月,將通義大模型事業部與未來生活實驗室合并,成立Token Foundry事業部,仍由吳泳銘直接負責,周靖人則轉任集團首席科學家,牽頭AI未來研究院。
三次調整的核心主線,是將AI業務從“技術驅動”的組織形態,逐步改造為“商業化驅動”的Token工廠。
此前,林俊旸離職的直接導火索之一,是通義實驗室計劃將Qwen團隊從“垂直整合”體系拆分為預訓練、后訓練、文本、多模態等水平分工團隊。拆分后,后訓練板塊由來自Google DeepMind的周浩接管,預訓練和多模態板塊的負責人則至今未公開披露。
林俊旸離職時,很大程度折射著阿里在“開源信仰”與“商業回報”的階段性博弈,現在Qwen3.8 Max預覽版上線,阿里選擇重新許下開源承諾。
從時間節點來看,全球市場的開源與閉源的力量對比正在發生根本性變化。Mozilla發布的《開源AI現狀報告》顯示,開源模型與閉源模型的平均性能差距已縮至3.3%,在編碼、指令執行等核心能力上已基本持平。
與此同時,OpenRouter數據顯示,開源模型處理的Token占比從2026年1月的34%飆升至6月的65%,全球API調用月消耗量前五名已全部被開源模型包攬。中國大模型更是在全球調用量中連續十一周領跑,開源模型下載量占比已達41%。
在開源生態上,7月22日,“阿里云開發者”公眾號正式更名為“千問AI平臺”,標志著阿里正式將Qwen的開發者生態,將過去依賴林俊旸個人魅力維系的開源互動,轉移到了一個由阿里官方直接運營、提供標準化服務的統一平臺上。
整體來看,Qwen3.8-Max正式版上線后選擇回歸開源,并非簡單的路線回調,這也是阿里在經歷內部路線分歧后,重新認清自身優勢、并在當下激烈的市場競爭中做出的商業選擇。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.