9月20日下午,DeepSeek出现服务异常,用户提交问题后只收到「服务器繁忙,请稍后重试」的提示,深度思考与联网搜索两个功能开关均无法正常使用。服务随后恢复,截至发稿官方未就原因作出说明。
这次故障本身持续时间不长,但发生的时间点值得关注。按照DeepSeek自身的峰谷定价规则,高峰时段为工作日早上9点至12点、下午2点至6点,周日傍晚属于算力相对宽松的闲时。闲时仍出现拥堵,说明问题可能不在峰值,而在日常负载水位。
把这次故障放进今年的时间线看,脉络更清晰。5月,DeepSeek一个月内连续出现四次服务异常,事后有分析指出,期间用户量增长66.7%,而算力储备仅增长8.3%,供需缺口由此拉开。7月中旬到8月初,V4正式版灰度期间服务频繁波动,开发者社区甚至通过API答题表现来推测灰度进度。8月4日,V4-Flash因「前所未有的访问量」出现性能下降,官方确认后完成修复。
从公开信息可以拼出一张算力底账。据公开报道,DeepSeek手中约有2万张H系列等效芯片,训练与推理仍在同一个资源池中竞争;自建的乌兰察布智算中心尚未完全交付。从4月开始,公司密集招聘数据中心运维、交付、IDC设计规划等岗位工程师,基建补课的迹象明显。
需求侧的增长则是另一个量级。OpenCode平台数据显示,8月1日V4-Flash单日处理8万亿token,其中5万亿来自免费试用额度;在OpenRouter周榜上,该模型一周被调用8.83万亿token,环比增长570%。
供需失衡之下,价格成为调节工具。回顾今年6月以来的多轮调价——峰谷定价、官宣「涨幅较大」、高峰价翻倍、V4-Pro高峰输出从6元涨到27元——本质上都指向同一件事:算力不够,用价格来筛。梁文锋在7月投资者交流会上曾表示,要以合理价格尽可能多地购买显卡,并称中美之间的AI差距主要是算力资源的差距。
但价格工具箱正在接近见底。峰谷定价、缓存折扣、周末低谷价、全线涨价,半年内负载管理手段基本用尽。涨价确实筛掉了一部分无效流量,但8万亿日调用量中仍有5万亿免费额度,这部分流量仍是最大的算力消耗来源。
往后看,可选路径大致有三条。继续涨价,但8月这轮之后,V4-Flash高峰时段相对OpenAI Luna的价格优势已基本磨平,再涨可能影响基本盘;削减免费额度,可能冲击C端口碑;等待乌兰察布数据中心交付,但数据中心建设以年计,短期难以缓解。
需要冷静看待的是,这次故障持续时间短且已恢复,官方未披露原因,「算力过载」是基于长期模式的合理推断,并非官方定性。DeepSeek Harness正处于两天一更的高频迭代期,工程层面的波动也可能引发类似现象。此外,服务拥堵在国产大模型圈并不罕见:Kimi K3发布后48小时内请求量触及集群极限,一度暂停新用户订阅;智谱年内也已三次涨价。算力紧张是全行业共同面对的背景。
把这次闲时拥堵与近期涨价放在一起看,DeepSeek今年的主线较为一致:技术口碑带来的流量增长,正在持续考验算力供给的边界。对用户而言,低价策略正让位于供需规律;对行业观察者而言,真正的变量不在价格表上,而在乌兰察布数据中心的交付进度。