8月13日,DeepSeek正式釋出DeepSeek-V4-Pro正式版API,大幅增強Agent能力,部分效能逼近甚至超越Claude Fable 5。這是繼7月31日推出V4-Flash正式版後,DeepSeek在智慧體賽道上的又一關鍵動作。
據官方基準測試,正式版相比預覽版效能全面提升,在AI安全智慧體基準測試套件Cybergym和工作流智慧體AutomationBench中,DeepSeek-V4-Pro正式版的表現均超越Fable 5。尤其值得注意的是,在針對長週期、高複雜度真實軟體工程的程式設計智慧體測試DeepSWE中,正式版得分從預覽版的12.8直接躍升至62.7,增幅近五倍,顯示出其在複雜任務處理上的顯著進步。
DeepSeek官方API文件顯示,模型版本已更新為DeepSeek-V4-Pro-0813,呼叫方法不變,開發者仍使用`deepseek-v4-pro`即可呼叫最新版本。新版增強了Agent能力,支援JSON結構化輸出、工具呼叫、Responses API及Anthropic API,為開發者構建智慧體應用提供了更靈活的介面。不過,正式版的併發限制為500,低於DeepSeek-V4-Flash的2500,這可能影響高併發場景下的使用體驗。
在社交平台X上,有網友反饋,目前網頁端與API介面呼叫的DeepSeek-V4-Pro思維鏈(CoT)表現存在明顯差異,API輸出的話術讀起來生硬、語序彆扭。這一反饋提示,儘管基準測試成績亮眼,但在實際API呼叫中,模型輸出的自然度仍有待最佳化。
目前DeepSeek尚未公佈V4-Pro的API價格,但8月6日官方預告,計劃近期整體上調DeepSeek API服務的定價,預計漲幅較大。這一動向與DeepSeek此前在預覽版釋出時提到的“下半年昇騰950超節點批次上市後會大幅下調Pro價格”形成對比,顯示出成本策略的調整。
從產業視角看,大模型比拼已進入智慧體決賽圈。DeepSeek-V4-Pro正式版在智慧體基準上的突破,進一步強化了其在Agent賽道的競爭力。然而,隨著各家模型在各大Agent基準的跑分差距不斷收窄,呼叫成本成為獨立開發者、初創團隊落地Agent專案的關鍵瓶頸。DeepSeek的漲價預告,可能促使部分開發者重新評估模型選型,或轉向成本更低的替代方案。
對於AI產業鏈而言,模型層的競爭加劇將傳導至下游應用生態,開發者對價效比的敏感度提升,或推動更多開源模型和輕量級方案的採用。同時,DeepSeek在智慧體能力上的投入,也反映出行業對複雜任務自動化需求的增長,這將帶動相關工具鏈和基礎設施的演進。