DeepSeek在8月17日对V4系列API进行了一次全面涨价,但仅仅23天后,即9月10日,便宣布对V4 Flash模型降价。此次降价主要针对输入价格,缓存命中输入最高降60%,缓存未命中输入降约33%,输出价格也有所下调,但降幅有限。值得注意的是,输出价格仍比4月最初价格贵一倍,而V4 Pro价格则完全未动。
此次价格调整的背景是,DeepSeek在8月17日将V4系列改为峰谷定价,工作日上午9点到12点、下午2点到6点为高峰时段,价格翻倍。以V4 Flash为例,空闲时段缓存命中输入从0.05元降至0.02元,缓存未命中输入从1.5元降至1元,均回到4月水平;但输出价格仅从4.5元降至4元,降幅约11%,仍比4月的2元贵一倍。高峰时段,输出价格仍为8元,是4月的4倍。
有媒体曾计算,V4 Pro的缓存命中输入价格从0.025元涨至高峰时段的0.3元,涨幅高达1100%。但此次降价并未涉及V4 Pro。
DeepSeek并未公开降价原因,但第三方平台OpenRouter的数据显示,V4 Flash在截至9月8日的30天内处理了约50.7万亿Token,位列所有模型第一,近一周处理约12.4万亿Token,排名第三。DeepSeek旗下模型合计占据OpenRouter近一周约23.8%的文本请求,超过OpenAI和Google。然而,V4 Flash的开源特性导致大量第三方供应商提供相同模型,价格远低于官方。例如,OpenInference的输入价格为每百万Token 0.05美元,输出0.16美元,而DeepSeek官方高峰时段分别为0.44美元和1.32美元。开发者只需更换API地址即可使用相同模型,无需付出额外成本。
分析认为,DeepSeek此次降价是开源模型面临的“宿命”——涨价后用户可转向第三方部署的相同模型,官方难以维持高价。此外,8月涨价时V4 Flash并未同步升级,用户多付钱却未获得更强能力,这也削弱了涨价的合理性。
就在降价前一天,DeepSeek开放了V4.1 Flash中间版本测试,新架构号称能力全面超过V4 Pro,且运行成本更低。但官方仍选择先降价,或许意在平衡收入与性价比优势。
同日,据路透社报道,DeepSeek已聘请中信证券筹备科创板IPO,计划今年启动上市程序,但具体时间、募资规模和估值尚未确定。
DeepSeek的定价困境折射出商业公司普遍面临的挑战:涨价需让用户看到价值提升,而开源模型还需应对来自“自己分身”的竞争。如何在赚钱与保持“便宜”标签之间找到平衡,是DeepSeek必须回答的问题。