深度求索(DeepSeek)於8月13日宣佈,將自北京時間2026年8月17日零時起大幅上調其API服務價格,並同步引入峰谷定價機制。以旗艦模型deepseek-v4-pro為例,高峰時段每百萬tokens輸出價格將從現行的6元升至27元,漲幅約350%;即便是空閒時段的13.5元,也達到現價的2.25倍。同時,DeepSeek V4 Pro正式版已於8月13日上線,並同步部署於APP、網頁端及API端。
此次調價覆蓋DeepSeek現有的兩款主力API模型——deepseek-v4-pro與deepseek-v4-flash,涉及輸入與輸出各計費維度。以deepseek-v4-flash為例,高峰時段每百萬tokens輸出價格從現行的2元升至9元,漲幅同為350%;快取未命中輸入價格從1元升至3元。deepseek-v4-pro的快取未命中輸入價格則從3元升至9元。快取命中場景的漲幅相對較小,但絕對價格同樣大幅提升:v4-flash快取命中輸入價格從0.02元升至高峰時段的0.10元,v4-pro則從0.025元升至0.30元。
新定價方案的核心在於引入峰谷兩檔差異定價,高峰時段價格為空閒時段的兩倍。高峰時段界定為北京時間每日9:00至12:00及14:00至18:00,其餘時間段均為空閒時段。若選擇在空閒時段呼叫,使用者可享受高峰價格的五折優惠,這為對時延不敏感的批次處理場景提供了一定的成本緩衝空間。
在宣佈調價的同時,深度求索於8月13日正式推出DeepSeek V4 Pro正式版,模型版本號為DeepSeek-V4-Pro-0813,API模型名保持不變。該模型已全面接入APP、網頁端和API三端,網頁端及APP使用者可通過選擇“專家模式”使用新版模型。V4 Pro支援思考與非思考雙模式,預設啟用思考模式,使用者可按需切換。技術規格方面,V4 Pro上下文長度達100萬tokens,最大輸出長度384K tokens,支援Json Output、Tool Calls、Responses API、Anthropic API及對話字首續寫等功能,併發限制為500路。相比之下,定位更輕量的deepseek-v4-flash併發限制達2500路,更適合高吞吐量場景。
對於大量依賴DeepSeek低價API構建產品的企業開發者而言,此次調價將實質性推高其運營成本。此前,DeepSeek憑藉極具競爭力的價格吸引了眾多中小開發者和創業團隊,此次漲價可能促使部分使用者轉向其他模型供應商,或調整自身的產品定價策略。同時,市場也可能對DeepSeek競爭優勢的持續性進行重新評估——在模型能力提升與商業化壓力之間,DeepSeek正在尋求新的平衡。峰谷定價機制的引入,則體現了其希望通過價格槓桿引導使用者錯峰呼叫、最佳化算力資源利用率的意圖。
從產業角度看,DeepSeek作為AI模型層的重要參與者,其定價策略的變化可能引發連鎖反應。一方面,其他模型廠商或跟隨調整價格;另一方面,依賴API的AI應用開發者將面臨成本上升,可能加速行業對模型價效比的重新考量。對於投資者而言,需關注DeepSeek的定價調整是否會影響其市場份額及生態粘性,以及下游應用企業的成本傳導能力。