DeepSeek V4 Pro上線 性能逼近Fable 5 價格只有它的2%
鉅亨網新聞中心
DeepSeek V4 Pro正式版於周三(12日)上線。目前DeepSeek未發布推文,唯一跡象是官網API定價頁面上的一行字變了,「deepseek-v4-pro」後面的版本號從預覽版變為DeepSeek-V4-Pro-0813。

這也意味著從2026年4月起以預覽版形式提供服務的旗艦模型,終於正式轉正。
據了解,DeepSeek V4 Pro是一個混合專家(MoE)模型,總參數量達到1.6兆,每個token激活490億參數,上下文窗口為100萬token,最大可以輸出38.4萬token,這個規模放在全球AI模型中位居第一梯隊。此前第三方測試主要使用預覽版本,相關模型在Hugging Face等平台已有大量下載。
正式版上線後的價格與非高峰時段價格保持一致。這一價格其實就是2026年5月永久降價至原價四分之一後的標準價格,具體來說,每百萬輸入token收費0.435美元,輸出收費0.87美元,緩存命中的輸入收費只需要0.003625美元。
相比之下,Anthropic的Claude Fable 5每百萬輸入token收費10美元,輸出收費50美元。以輸出token價格計算,兩者相差近58倍,DeepSeek V4 Pro的價格還不到Claude Fable 5的2%。
要是按完成單個任務的成本來算,差距可能更加明顯。有機構測試過,使用Claude Fable 5完成一個基準任務花費3.15美元,使用DeepSeek V4 Flash只需花費3美分,兩者相差100倍。DeepSeek-V4-Pro-0813版本的單任務成本目前還缺乏充分的第三方測試,但由於目前API價格體系沒有變化,實際成本差距仍可能相當可觀。
之所以價格差距能拉這麼大,主要與架構設計有關。DeepSeek V4 Pro使用了兩種注意力變體,分別是壓縮稀疏注意力(Compressed Sparse Attention)和重度壓縮注意力(Heavily Compressed Attention)。
按照DeepSeek的說法,這套架構能夠把單token推理計算量降至V3.2的27%,KV緩存則降至原來的10%。這對於100萬token的上下文窗口來說,能夠節省的成本相當可觀。由於推理效率提高,也為模型提供了更大的定價空間。
DeepSeek自己也進行了基準測試,在10項智能體評測中與Claude Fable 5進行比較。去掉差距最大的一項之後(Humanity"s Last Exam,DeepSeek V4 Pro落後10.6個百分點),剩下9項中DeepSeek平均落後2.8%,其中有2項DeepSeek勝出。
不過,這些數據是DeepSeek自行測試的結果,使用的是自家尚未對外開放的評測框架,而且相關內部測試集也沒有公開榜單可以驗證。因此,DeepSeek-V4-Pro-0813版本的實際表現,仍有待第三方評測進一步確認。上述數據目前只能說明DeepSeek認為V4 Pro在部分測試中已接近Claude Fable 5,尚不能直接視為兩者整體性能相當。
DeepSeek V4 Pro在API中提供不同程度的推理模式,包括非思考及不同推理強度的設定。其中,較高的推理模式可以進一步提升模型的推理能力。API同時支援OpenAI和Anthropic兩種格式的接口,先前已在這兩個生態系統中開發的開發者無需大幅修改程式碼即可切換使用,同時支援工具調用、結構化JSON輸出等功能。
DeepSeek V4 Pro正式版上線後,DeepSeek V4系列的產品結構變得更加清晰:一方面,Flash版本負責高頻、高併發的使用場景,主打低價格;Pro版本則將更多算力集中在複雜推理、長上下文編碼及智能體任務上。部分AI開發公司已開始搭配使用兩種版本。
不過,DeepSeek的定價頁面也已預告,近期將進行一次「顯著的價格調整」。至於具體漲幅以及何時調整,目前尚未公布,因此目前這個低價窗口還能維持多久,仍有待觀察。
同時,多家聚合平台的數據顯示,2026年7月DeepSeek模型的Token調用規模已位居全球AI模型第一梯隊,在部分榜單中僅次於Anthropic的模型。DeepSeek的業務增長主要依託開發者的實際API調用,迄今為止也沒有舉辦大型媒體發布會,主要透過公眾號宣布產品消息,有時也會發布技術博客。
眾所周知,DeepSeek的算力儲備相較海外AI頭部企業並不算大。根據7月流出的投資人交流會內容,梁文鋒曾提到,當時DeepSeek擁有約2萬張H100等效算力。這個數字與海外AI頭部大廠動輒幾十萬甚至上百萬張GPU的集群相比,確實不在同一個量級。
不過,梁文鋒也表示這個數字是動態的,DeepSeek一直在努力採購更多算力,並計畫「在合理價格內能買多少卡就買多少卡」。與此同時,DeepSeek據報也在規劃GW級的自建算力基礎設施,近期針對內蒙古資料中心相關職位的招聘,也被外界視為其擴充算力布局的跡象。
DeepSeek還與華為合作。根據流出的投資人交流會內容,DeepSeek獲得華為約1.6萬張昇騰950算力卡的配置,用於軟體生態驗證與落地。另有第三方機構已在中國國產算力集群(昇騰910C)上完成DeepSeek V4 Pro的全參數後訓練,這顯示國產算力正在逐步承擔更重的AI模型訓練任務。
目前DeepSeek V4系列採用MIT授權的開放權重模式。至於DeepSeek-V4-Pro-0813正式版權重的公開進度,仍需以官方後續公告為準。按照V4 Flash「API先跑、權重隨後跟上」的節奏,市場仍在等待正式版權重的進一步消息。
第三方評測機構目前也正在陸續測試DeepSeek-V4-Pro-0813版本。待更多獨立評測數據公布後,才能更清楚判斷DeepSeek V4 Pro這次的性能提升幅度,以及它與Claude Fable 5等頂級模型之間的實際差距。
- 台股洗牌!AI狂潮後 誰是下座護國神山?
- 掌握全球財經資訊點我下載APP
延伸閱讀
- DeepSeek要挑戰Claude Code!成立AI代理新團隊大舉徵才
- AI巨頭狂吸金!Anthropic獨攬650億美元 助攻Q2全球創投寫歷史次高
- AI驚傳脫序駭客事件!資安成下一波投資熱潮 專家點名 Palo Alto、CrowdStrike率先受惠
- 〈財報〉AI支出狂潮助營收翻倍 CoreWeave盤後飆15%
- 講座
- 公告
下一篇