深度求索(DeepSeek)于8月13日宣布,将自北京时间2026年8月17日零时起大幅上调其API服务价格,并同步引入峰谷定价机制。以旗舰模型deepseek-v4-pro为例,高峰时段每百万tokens输出价格将从现行的6元升至27元,涨幅约350%;即便是空闲时段的13.5元,也达到现价的2.25倍。同时,DeepSeek V4 Pro正式版已于8月13日上线,并同步部署于APP、网页端及API端。

此次调价覆盖DeepSeek现有的两款主力API模型——deepseek-v4-prodeepseek-v4-flash,涉及输入与输出各计费维度。以deepseek-v4-flash为例,高峰时段每百万tokens输出价格从现行的2元升至9元,涨幅同为350%;缓存未命中输入价格从1元升至3元。deepseek-v4-pro的缓存未命中输入价格则从3元升至9元。缓存命中场景的涨幅相对较小,但绝对价格同样大幅提升:v4-flash缓存命中输入价格从0.02元升至高峰时段的0.10元,v4-pro则从0.025元升至0.30元

新定价方案的核心在于引入峰谷两档差异定价,高峰时段价格为空闲时段的两倍。高峰时段界定为北京时间每日9:00至12:0014:00至18:00,其余时间段均为空闲时段。若选择在空闲时段调用,用户可享受高峰价格的五折优惠,这为对时延不敏感的批量处理场景提供了一定的成本缓冲空间。

在宣布调价的同时,深度求索于8月13日正式推出DeepSeek V4 Pro正式版,模型版本号为DeepSeek-V4-Pro-0813,API模型名保持不变。该模型已全面接入APP、网页端和API三端,网页端及APP用户可通过选择“专家模式”使用新版模型。V4 Pro支持思考与非思考双模式,默认启用思考模式,用户可按需切换。技术规格方面,V4 Pro上下文长度达100万tokens,最大输出长度384K tokens,支持Json OutputTool CallsResponses APIAnthropic API及对话前缀续写等功能,并发限制为500路。相比之下,定位更轻量的deepseek-v4-flash并发限制达2500路,更适合高吞吐量场景。

对于大量依赖DeepSeek低价API构建产品的企业开发者而言,此次调价将实质性推高其运营成本。此前,DeepSeek凭借极具竞争力的价格吸引了众多中小开发者和创业团队,此次涨价可能促使部分用户转向其他模型供应商,或调整自身的产品定价策略。同时,市场也可能对DeepSeek竞争优势的持续性进行重新评估——在模型能力提升与商业化压力之间,DeepSeek正在寻求新的平衡。峰谷定价机制的引入,则体现了其希望通过价格杠杆引导用户错峰调用、优化算力资源利用率的意图。

从产业角度看,DeepSeek作为AI模型层的重要参与者,其定价策略的变化可能引发连锁反应。一方面,其他模型厂商或跟随调整价格;另一方面,依赖API的AI应用开发者将面临成本上升,可能加速行业对模型性价比的重新考量。对于投资者而言,需关注DeepSeek的定价调整是否会影响其市场份额及生态粘性,以及下游应用企业的成本传导能力。