8月17日零时起,国产大模型DeepSeek正式实施新一轮API价格调整,首次引入峰谷定价机制。根据官方公告,高峰时段定为北京时间9:00至12:00及14:00至18:00,其余时间为空闲时段。以旗舰模型DeepSeek-V4-Pro为例,空闲时段每百万Tokens输入价格(缓存命中)为0.15元、(缓存未命中)为4.5元,输出价格为13.5元;高峰时段上述价格翻倍,分别升至0.3元、9元和27元。相比调价前V4-Pro每百万Tokens输入(缓存命中)0.025元、输入(缓存未命中)3元、输出6元的价格,高峰时段涨幅最高达1100%。DeepSeek表示,此次调整旨在更合理调配资源,鼓励用户根据实际使用情况调整任务时间。
此次涨价并非孤例。2026年,国产大模型行业正迎来一轮集体涨价潮。智谱年内已三次提价;月之暗面随Kimi K3发布,API定价大幅上调,输入价格涨幅超3倍、输出价格涨幅接近4倍。据每日经济新闻援引摩根士丹利8月9日研报,2026年第二季度中国大模型平均API输入价格升至每百万Token 4.9元,输出价格升至21.9元,相比2025年第一季度的3.3元和12.2元,分别上涨约48%和80%。
DeepSeek此前长期扮演“价格屠夫”角色。2024年底发布的V3系列以极低训练成本实现媲美顶尖模型的性能;2025年1月推出的R1模型,输出API价格仅为OpenAI o1的3%。今年4月,DeepSeek发布V4系列预览版,并将全系输入缓存命中价格降至首发价的1/10,V4-Pro叠加限时2.5折,百万Tokens输入缓存命中低至0.025元,创全球大模型价格新低。5月,DeepSeek宣布V4-Pro在优惠结束后调整为原价的1/4。低价策略推动调用量激增,据OpenRouter统计,7月27日至8月2日,DeepSeek-V4-Flash以7.22万亿Token周调用量排名全球第一;8月3日至16日,正式版连续两周以8.83万亿、11.2万亿Token登顶。
然而,激增的调用量也给服务器带来压力。8月4日,海外开源AI Coding Agent平台OpenCode称,DeepSeek-V4-Flash因前所未有的访问量出现容量不足问题,引发报错。据第一财经,当时有用户反映官方API上午几乎不可用,DeepSeek随后表示问题已解决。这背后是算力资源紧张的严峻现实。据中国发展高层论坛2026年年会披露,今年3月中国日均Token调用量突破140万亿,相比2024年初的1000亿增长超千倍。供应端,高端GPU与HBM显存持续紧张,英伟达Blackwell、Hopper系列产能供不应求。中国信通院数据显示,2026年一季度国内AI算力需求同比增长417%,有效供给增速仅128%,供需缺口拉大。此前月之暗面Kimi就曾因算力紧张暂停C端新用户订阅。
分析人士认为,DeepSeek的价格转向标志着国产大模型由价格竞争回归价值竞争。摩根士丹利研报指出,中国大模型行业正在建立更健康的商业化环境,竞争重点从价格转向模型能力,长期竞争地位的关键在于模型智能而非价格,单纯低价会压低毛利、限制研发资金。浙商证券认为,DeepSeek带头涨价打破了“模型价格无限内卷”的悲观预期,抬升了国产大模型的估值锚。尽管大幅调价,DeepSeek仍具价格优势,据国盛证券测算,V4-Pro高峰时段输出价格仅为Claude旗舰模型的约1/13,闲时约1/25。