DeepSeek V4 Pro突襲上線 Agent能力大躍進、性能逼近Fable 5
鉅亨網新聞中心
中國 AI 新創 DeepSeek 深夜無預警出招。8 月 12 日深夜,官網 API 文件悄悄將模型切換至「DeepSeek-V4-Pro-0813」,顯示 V4 Pro 正式版很可能已透過 API 上線。更受矚目的是,社群流出的評測顯示,新版在多項 AI 智能體(Agent)測試中逼近 Anthropic 的 Claude Fable 5,部分項目甚至超越;加上幾乎與 Grok 4.6 同步登場,前沿 AI 模型的效能與價格戰再度升溫。

從 DeepSeek 官網變化來看,這次 V4 Pro 正式版上線相當低調。目前官方 API「模型與價格」頁面已將 deepseek-v4-pro 對應版本標示為 DeepSeek-V4-Pro-0813,支援 100 萬 Token 上下文、最高 38.4 萬 Token 輸出,以及 JSON Output、Tool Calls、Responses API、Anthropic API 與 FIM 等功能。
官方「首次呼叫 API」頁面也已將 deepseek-v4-pro 列為可呼叫模型,並提供思考模式的呼叫範例,顯示新版模型已進入實際服務階段。
不過,DeepSeek 至今仍未同步發布 V4-Pro-0813 的正式更新日誌。官方更新頁面最新公告仍停留在 7 月 31 日的 V4 Flash 正式版,當時明確表示僅升級 V4 Flash API,V4 Pro API 及 App、Web 端模型並未改變,同時預告「DeepSeek-V4-Pro 正式版將會盡快發布」。
因此嚴格來說,目前較精確的說法是 V4 Pro 正式版已透過 API 上線,而非 DeepSeek 已正式發布完整的 V4 Pro 產品公告。
Agent能力躍升 多項測試逼近Fable 5
真正引發 AI 社群關注的,是流傳中的新版評測對比表。多家科技媒體引述 DeepSeek 官方群組發布的資料指出,DeepSeek-V4-Pro-0813 在多項測試中的表現已接近 Fable 5,相較先前 V4 Pro 預覽版有明顯提升,其中又以智能體相關測試最受矚目。
不同於傳統大型語言模型主要比較知識問答、數學與邏輯推理,Agent 測試更著重 AI 實際「幹活」的能力,包括工具呼叫、多步驟任務、程式碼編寫與修改,以及持續執行複雜工作,而這正是 DeepSeek V4 系列一路押注的方向。
DeepSeek 今年 4 月推出 V4 預覽版時便強調,V4 Pro 在 Agentic Coding 評測中達到當時開源模型領先水準,並針對 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 產品進行適配與最佳化,同時支援 100 萬 Token 上下文與思考模式。
到了 7 月底,V4 Flash 正式版進一步強化智能體能力,DeepSeek 公布 Terminal Bench 2.1、NL2Repo、DeepSWE 與 Toolathlon verified 等多項測試成績,並稱正式版 Agent 能力已大幅超越 V4-Pro-Preview。如今 V4 Pro 正式版進一步逼近 Fable 5,意味 DeepSeek 在 Agent 領域累積的後訓練與工程最佳化,正逐步轉化為更強的實際任務執行能力。
不過,目前新版評測表主要來自官方群組及社群流傳,DeepSeek 尚未在官方更新日誌公布 V4-Pro-0813 的完整基準測試成績,因此相關分數仍屬非正式披露,不能完全等同官方正式公布的基準成績。
能力升級價格不變 但漲價已在路上
除了性能,價格也是此次 V4 Pro 更新的另一大焦點。目前 DeepSeek API 價格頁面顯示,新版 V4 Pro 並未隨能力升級同步調漲價格,延續先前大幅降價後的低價策略。
但低價可能不會維持太久。DeepSeek 已在官網價格頁面明確預告,計畫在不久的將來調高 DeepSeek API 服務整體價格,而且「預計漲幅較大」,實際價格則有待官方後續通知。
換言之,現階段 V4 Pro 正式版呈現「效能升級、價格暫時不變」的狀態,但未必能長期維持。這也讓此次更新更像是在漲價前先完成一波模型效能升級與產品切換,再視算力供給、呼叫量及商業化狀況調整價格。
撞車Grok 前沿模型價格戰升溫
更巧的是,DeepSeek V4 Pro-0813 上線時間,幾乎與 Grok 4.6 正面撞車。
就在 DeepSeek 新版模型悄悄現身前幾個小時,Grok 4.6 才剛發布。根據檔案資料,Grok 4.6 在 Artificial Analysis 推出的 GDPVal-AA v2 智能體評估中拿下 1753 Elo,排名第一;Artificial Analysis Intelligence Index 則取得 61 分。
價格同樣成為 Grok 的主要武器。Grok 4.6 API 定價為每百萬輸入 Token 2 美元、輸出 6 美元,主打相較其他前沿模型更低的成本。如今 DeepSeek V4 Pro-0813 又在多項測試中逼近 Fable 5,同時維持低價,兩款模型幾乎同時向市場釋出相同訊號:前沿模型之間的能力差距持續縮小,而價格正成為下一階段更重要的競爭武器。
過去 AI 模型競爭主要圍繞「誰是最強模型」展開,但當 DeepSeek、Grok 等模型不斷向第一梯隊逼近,市場的比較方式也開始改變。如果效能差距已縮小到一定程度,開發者是否還願意為更昂貴的模型支付數倍成本,正成為新的競爭焦點。
從「便宜」走向「能幹活」
DeepSeek V4 Pro 此次升級的意義,也不只是一次普通版本迭代。
今年 4 月推出 V4 時,DeepSeek 已將重心由傳統聊天模型轉向 Agent,把百萬 Token 上下文、程式碼工程與工具呼叫能力列為核心賣點;隨後 V4 Flash 正式版又進一步強化 Code Agent、Search Agent 等能力。
如今 V4 Pro 正式版持續向 Fable 5 等頂級閉源模型靠攏,顯示 DeepSeek 的競爭目標已不只是打造「更便宜的通用大模型」,而是試圖在 AI 從聊天走向實際工作的過程中,搶占 Agent 基礎模型的位置。
這也與 Grok 4.6 的升級方向不謀而合。Grok 4.6 同樣將長時間運行的智能體、複雜程式設計與知識工作列為重點,並透過開發者工具提供服務。
DeepSeek V4 Pro-0813 與 Grok 4.6 幾乎同日登場,某種程度也折射出 AI 產業競爭進入新階段:前沿模型戰場正從單純比拚參數、聊天與基準測試能力,轉向智能體執行能力、Token 成本與開發者生態的全面較量。
延伸閱讀
- DeepSeek不再獨領風騷?Meta、輝達殺入開放模型戰場
- DeepSeek獲戰略配售!宇樹科技發行價人民幣150.8元 上市市值約609億元
- 突破7兆!DeepSeek V4 Flash單周調用量全球登頂
- Google AI換帥背後 布林施壓Gemini全力追趕Anthropic與OpenAI
- 講座
- 公告
下一篇