DeepSeek V4 Pro正式版似乎在毫無預告的情況下突然上線。
北京時間8月12日周三深夜,DeepSeek官網API文檔悄然更新,模型版本已經從此前的V4-Pro預覽版切換至DeepSeek-V4-Pro-0813。官方“模型 & 價格”頁面目前已經將deepseek-v4-pro對應的模型版本明確標為DeepSeek-V4-Pro-0813,同時API價格暫未出現明顯上調。
這意味著,DeepSeek V4 Pro正式版很可能已經開始通過API灰度或正式提供服務。多家科技媒體援引DeepSeek官方群流出的評測對比表稱,新模型在多項智能體(Agent)測試中的表現已經逼近Anthropic前沿模型Claude Fable 5,部分項目甚至超過Fable 5;相比此前的V4 Pro預覽版,整體表現明顯提升。
更巧合的是,DeepSeek這次更新幾乎與馬斯克旗下SpaceXAI發布Grok 4.6同步。兩款主打高性價比的模型幾乎同時沖擊前沿模型第一梯隊,AI大模型價格與性能競爭再度升溫。
API文檔悄然換版,官方仍未發布正式更新日志
從DeepSeek官網的變化來看,這次V4 Pro正式版上線頗為低調。
目前DeepSeek API官方“模型 & 價格”頁面已經顯示,deepseek-v4-pro對應的模型版本為DeepSeek-V4-Pro-0813;該模型支持1M上下文、最高384K輸出,并支持JSON Output、Tool Calls、Responses API、Anthropic API以及FIM等功能。
官方“首次調用API”頁面也已經將可調用模型列為deepseek-v4-pro,并給出了使用該模型進行思考模式調用的示例。
但值得注意的是,DeepSeek目前并沒有同步發布V4-Pro-0813的官方更新日志。
DeepSeek的更新日志頁面最新一條仍是7月31日的V4-Flash正式版更新。該公告當時明確表示,7月31日僅升級V4-Flash API,V4-Pro API及App/Web端模型并未改變,并稱“DeepSeek-V4-Pro正式版將會盡快發布”。截至目前,這一更新日志頁面仍未出現V4-Pro-0813的正式發布說明。
由于最先發現變化的并不是DeepSeek官方公告,而是API文檔和實際調用端。因此,嚴格來說,現階段更適合將此次事件視為DeepSeek V4 Pro正式版已通過API上線,而并非DeepSeek已發布完整、正式的V4 Pro產品公告。
多項智能體測試逼近Fable 5,預覽版到正式版提升明顯
真正引發市場關注的,是已經在AI社區流傳的評測對比表。
媒體援引DeepSeek官方群發布的評測表稱,DeepSeek V4 Pro正式版,即DeepSeek-V4-Pro-0813,在多項測試中已經接近Fable 5水平,相比此前的V4 Pro預覽版能力出現大幅提升。
其中尤其值得關注的是智能體相關測試。
與傳統大模型主要考察知識問答、數學推理不同,智能體測試更加接近AI“真正干活”的能力,包括能否調用工具、執行多步驟任務、編寫和修改代碼,以及持續推進復雜工作。
這也是DeepSeek V4系列從一開始就重點押注的方向。
DeepSeek在4月發布V4預覽版時就強調,V4 Pro在Agentic Coding評測中達到當時開源模型領先水平,并針對Claude Code、OpenClaw、OpenCode、CodeBuddy等主流Agent產品進行了適配和優化。V4 Pro同時支持1M上下文以及思考模式,可通過reasoning_effort調整思考強度。
7月31日發布V4 Flash正式版時,DeepSeek又披露了智能體能力的大幅增強,包括Terminal Bench 2.1達到82.7、NL2Repo達到54.2、DeepSWE達到54.4、Toolathlon verified達到70.3等,并明確表示正式版智能體能力遠超V4-Pro-Preview。
如今V4 Pro正式版進一步向Fable 5靠攏,意味著DeepSeek此前在Agent方向的積累正在通過后訓練和工程優化轉化為更強的實際任務執行能力。
不過,由于目前流傳的新版評測表主要來自官方群及社區,DeepSeek尚未在官方更新日志中公布完整的V4-Pro-0813基準成績,因此這些具體分數仍應視為非官方披露數據,而不能與DeepSeek正式發布的基準成績完全等同。
價格暫未上調,但官網已經預告近期將大幅漲價
價格是這次V4 Pro正式版上線的另一大看點。
截至目前,DeepSeek官方API價格頁面仍顯示,V4 Pro每百萬Token的緩存命中輸入價格為0.003625美元,緩存未命中輸入價格為0.435美元,輸出價格為0.87美元;按照此前人民幣計價口徑,大致對應3元/百萬Token輸入、6元/百萬Token輸出。
也就是說,新版V4 Pro目前并沒有因為模型能力提升而同步漲價。
此前DeepSeek已經把V4 Pro API價格從首發價格永久下調至原價的四分之一,輸入緩存命中、輸入緩存未命中和輸出價格分別降至0.025元、3元和6元/百萬Token。
不過,這次官網實際上埋下了一個值得關注的伏筆。
DeepSeek目前在價格頁面明確寫明:“我們計劃在不久的將來上調DeepSeek API服務的整體價格”,而且“預計漲幅較大”,但具體價格仍需等待官方通知。
因此,當前V4 Pro正式版“能力升級、價格暫不變”的狀態,未必能夠長期維持。
這也讓此次更新更像是一場在漲價之前的性能升級與產品切換:DeepSeek先把新模型推向API用戶,隨后再根據算力供給、調用量和商業化情況調整價格。
一邊是DeepSeek,一邊是Grok:前沿模型競爭突然“撞車”
如果沒有Grok 4.6,這次DeepSeek V4 Pro的突然上線可能已經足夠引發市場關注。
但時間點實在太巧。
就在DeepSeek V4 Pro-0813悄然上線前幾個小時,SpaceXAI剛剛發布Grok 4.6。
Grok 4.6在Artificial Analysis推出的GDPVal-AA v2——一項面向真實世界專業知識工作的AI智能體評估——中取得1753 Elo,排名第一,超過OpenAI前沿模型GPT-5.6 Sol Max的1728分,以及Anthropic的Claude Fable 5的1741分。SpaceXAI同時稱,Grok 4.6在Artificial Analysis Intelligence Index中取得61分,與GPT-5.6 Sol Max持平。
更重要的是價格:Grok 4.6 API定價為每百萬輸入Token 2美元、輸出6美元,SpaceXAI直接將其定位為其他前沿模型的一半價格。
如今DeepSeek V4 Pro-0813又在多項測試中逼近Fable 5,而且目前仍維持每百萬Token輸入3元、輸出6元的價格。
兩款模型幾乎在同一時間向市場釋放了類似信號:前沿模型的能力差距正在縮小,而價格優勢正在成為新的競爭武器。
這對OpenAI、Anthropic等傳統前沿模型廠商而言,壓力并不僅僅來自“誰的跑分更高”。
此前AI模型競爭更多圍繞“最強模型”展開,而隨著DeepSeek和Grok不斷把性能推向第一梯隊,市場開始出現另一種競爭邏輯:如果性能已經足夠接近,開發者為什么要為更貴的模型支付數倍成本?
從“便宜”到“能干活”,DeepSeek重新沖擊智能體市場
DeepSeek V4 Pro此次升級的意義,也可能超過一次普通的模型版本迭代。
今年4月V4發布時,DeepSeek就已經把重點從傳統聊天模型轉向Agent,并將百萬Token上下文、代碼工程和工具調用能力作為核心賣點。
隨后V4 Flash正式版上線,又重點強化Code Agent和Search Agent等能力。DeepSeek在7月31日的更新中甚至直接表示,V4 Flash正式版的智能體能力大幅增強,并在多項智能體基準測試中明顯超過V4-Pro-Preview。
如今V4 Pro正式版繼續向Fable 5等頂級閉源模型靠攏,說明DeepSeek的競爭目標已經不再只是“做一個更便宜的通用大模型”,而是試圖在AI從聊天走向實際工作的過程中,爭奪Agent基礎模型的位置。
而這恰恰也是Grok 4.6此次升級的核心方向。
Grok 4.6同樣將長時間運行的智能體、復雜編程和知識工作作為重點,并在Cursor等開發者入口直接提供服務。
因此,DeepSeek V4 Pro-0813與Grok 4.6的“同日撞車”,某種程度上也折射出AI行業競爭的新階段:
前沿模型的競爭正在從單純比拼參數和聊天能力,轉向比拼智能體執行能力、Token成本以及開發者生態。
而這場競爭,可能才剛剛開始。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.