8月17日零時起,國產大模型DeepSeek正式實施新一輪API價格調整,首次引入峰谷定價機制。根據官方公告,高峰時段定為北京時間9:00至12:00及14:00至18:00,其餘時間為空閒時段。以旗艦模型DeepSeek-V4-Pro為例,空閒時段每百萬Tokens輸入價格(快取命中)為0.15元、(快取未命中)為4.5元,輸出價格為13.5元;高峰時段上述價格翻倍,分別升至0.3元、9元和27元。相比調價前V4-Pro每百萬Tokens輸入(快取命中)0.025元、輸入(快取未命中)3元、輸出6元的價格,高峰時段漲幅最高達1100%。DeepSeek表示,此次調整旨在更合理調配資源,鼓勵使用者根據實際使用情況調整任務時間。

此次漲價並非孤例。2026年,國產大模型行業正迎來一輪集體漲價潮。智譜年內已三次提價;月之暗面隨Kimi K3釋出,API定價大幅上調,輸入價格漲幅超3倍、輸出價格漲幅接近4倍。據每日經濟新聞援引摩根士丹利8月9日研報,2026年第二季度中國大模型平均API輸入價格升至每百萬Token 4.9元,輸出價格升至21.9元,相比2025年第一季度的3.3元和12.2元,分別上漲約48%和80%。

DeepSeek此前長期扮演“價格屠夫”角色。2024年底釋出的V3系列以極低訓練成本實現媲美頂尖模型的效能;2025年1月推出的R1模型,輸出API價格僅為OpenAI o1的3%。今年4月,DeepSeek釋出V4系列預覽版,並將全系輸入快取命中價格降至首發價的1/10,V4-Pro疊加限時2.5折,百萬Tokens輸入快取命中低至0.025元,創全球大模型價格新低。5月,DeepSeek宣佈V4-Pro在優惠結束後調整為原價的1/4。低價策略推動呼叫量激增,據OpenRouter統計,7月27日至8月2日,DeepSeek-V4-Flash以7.22萬億Token周呼叫量排名全球第一;8月3日至16日,正式版連續兩週以8.83萬億、11.2萬億Token登頂。

然而,激增的呼叫量也給伺服器帶來壓力。8月4日,海外開源AI Coding Agent平台OpenCode稱,DeepSeek-V4-Flash因前所未有的訪問量出現容量不足問題,引發報錯。據第一財經,當時有使用者反映官方API上午幾乎不可用,DeepSeek隨後表示問題已解決。這背後是算力資源緊張的嚴峻現實。據中國發展高層論壇2026年年會披露,今年3月中國日均Token呼叫量突破140萬億,相比2024年初的1000億增長超千倍。供應端,高階GPUHBM視訊記憶體持續緊張,輝達Blackwell、Hopper系列產能供不應求。中國信通院資料顯示,2026年一季度國內AI算力需求同比增長417%,有效供給增速僅128%,供需缺口拉大。此前月之暗面Kimi就曾因算力緊張暫停C端新使用者訂閱。

分析人士認為,DeepSeek的價格轉向標誌著國產大模型由價格競爭迴歸價值競爭。摩根士丹利研報指出,中國大模型行業正在建立更健康的商業化環境,競爭重點從價格轉向模型能力,長期競爭地位的關鍵在於模型智慧而非價格,單純低價會壓低毛利、限制研發資金。浙商證券認為,DeepSeek帶頭漲價打破了“模型價格無限內卷”的悲觀預期,抬升了國產大模型的估值錨。儘管大幅調價,DeepSeek仍具價格優勢,據國盛證券測算,V4-Pro高峰時段輸出價格僅為Claude旗艦模型的約1/13,閒時約1/25。