阿里千問的AI圖像生成能力,今天完成了一次大版本跳級。
7月21日,通義千問正式發布第三代圖像生成基礎模型Qwen-Image-3.0,主打復雜指令理解與商用級細節渲染。而就在兩天前,其2.4萬億參數的旗艦語言大模型Qwen3.8-Max預覽版剛剛上線。一周內兩款核心模型連發,阿里大模型的迭代節奏明顯提速。
![]()
這款新圖像模型最核心的突破,是將指令輸入長度提升至4.5k token,約合三千余漢字。此前主流AI繪圖工具大多只能承接短句創意需求,遇到帶規范版式、大量文字的商用場景,輸出結果往往需要大量后期返工。更長的指令窗口意味著,九宮格知識圖解、多頁學術海報、復雜UI界面這類包含多層邏輯與細節的需求,如今可以一次性描述清楚,直接生成可用成品。
根據官方測試數據,Qwen-Image-3.0的細節渲染精度達到10像素級別,小字清晰可辨,人像質感接近攝影級真實效果。模型同時支持12國語言原生文字渲染,可仿真20余款字體,無需后期修圖即可直接產出多語言產品海報、影視分鏡、教育課件。古畫修復、手繪草圖轉PPT、全景圖生成等編輯能力也同步上線。目前該模型已在阿里云百煉和千問AI平臺開放API邀測,個人用戶端免費體驗入口將于近期上線。
如果說圖像模型瞄準的是落地最后一公里,那么兩天前登場的Qwen3.8-Max,則是在基礎能力天花板上再進一步。
7月19日發布的Qwen3.8-Max預覽版,總參數量達到2.4萬億,是千問系列首個突破萬億參數門檻的產品,也是目前國內公開參數規模最大的大模型之一。和全球頂級大模型的主流技術路線一致,它采用MoE混合專家架構——名義參數體量巨大,但推理時僅激活部分權重參與計算,實際算力消耗與成本遠低于名義規模對應的水平,兼顧了能力上限與落地性價比。
![]()
通義千問官方披露的測評數據顯示,新模型重點強化了代碼工程、長文檔處理與復雜邏輯推理能力,多步數學推導、多輪工具調用的準確率較上一代有明顯提升。作為多模態模型,它支持文本、圖片、視頻、文檔等多種輸入形態,基本覆蓋企業辦公主流信息處理場景,官方自測綜合表現位列全球第一梯隊。
更受行業關注的是權重開放信號。官方明確表示,正式版將開放Qwen3.8-Max的完整模型權重,企業與開發者可將模型部署在自有服務器上,進行二次開發與私有化微調。對金融、制造、政務等數據敏感型行業而言,可私有化部署是大模型規模化落地的核心前提。目前預覽版已接入阿里云TokenPlan、AI編程工具Qoder與企業工作流產品QoderWork,網頁搜索、代碼解釋器、圖文檢索等工具調用能力已全部開放。
算上此次更新,今年以來千問已經從3.5系列迭代到3.8旗艦,半年內完成三次大版本升級。高密度的版本更新背后,是阿里云算力底座的工程化支撐,也是當前國內大模型賽道的普遍節奏。
前兩年行業還在爭論參數規模的意義,如今萬億參數模型已進入常態化發布周期。
來源:星河商業觀察
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.