9月20日下午,DeepSeek服务再次出现异常。用户输入问题后只收到“服务器繁忙,请稍后重试”的提示,深度思考与联网搜索两个功能开关均无法正常使用。故障持续时间不长,服务随后恢复,截至发稿官方未就原因作出说明。
真正引发讨论的,是这次故障发生的时间点。按照DeepSeek自己的峰谷定价规则,高峰时段为工作日早上9点至12点、下午2点至6点,而周日傍晚属于闲时,本应是算力最宽松的窗口。闲时都出现“繁忙”,让外界对其日常负载水位产生更多联想。
这并非孤立事件。回顾今年以来的时间线:5月,DeepSeek一个月内连续崩溃四次,事后有分析指出用户量暴涨66.7%,而算力储备仅增长8.3%,缺口由此拉开;7月中旬到8月初,V4正式版灰度期间服务频繁波动,开发者社区甚至靠API答题表现来反推灰度进度;8月4日,V4-Flash因“前所未有的访问量”出现性能下降,官方确认后修复。加上这次周日闲时故障,服务稳定性问题已反复出现。
算力底账是理解这一系列现象的关键。据公开报道,DeepSeek手中约有2万张H系列等效芯片,训练和推理仍在同一个资源池中竞争;自建的乌兰察布智算中心尚未完全交付。从4月开始,公司密集招聘数据中心运维、交付、IDC设计规划等岗位,基建补课的意图明显。
需求侧的增长则是另一个量级。OpenCode平台数据显示,8月1日V4-Flash单日处理8万亿token,其中5万亿来自免费试用额度;在OpenRouter周榜上,它一周被调用8.83万亿token,环比暴涨570%。单一模型承载的调用量已接近半个平台的规模。
供需失衡直接体现在定价策略上。今年6月以来,DeepSeek多轮调价——峰谷定价、官宣涨幅较大、高峰价翻倍、V4-Pro高峰输出从6元涨到27元——本质上都是算力紧张的不同表达。梁文锋7月在投资者交流会上曾表示,要以合理价格尽可能多地购买显卡,中美之间的AI差距主要是算力资源的差距。
但价格工具的腾挪空间正在收窄。峰谷定价、缓存折扣、周末低谷价、全线涨价,半年内负载管理手段几乎用遍。涨价确实筛掉部分无效流量,但8万亿日调用量中5万亿免费额度仍是最大的算力消耗来源。后续路径大致有三条:继续涨价,但V4-Flash高峰时段对OpenAI Luna的价格优势已基本磨平,再涨可能影响基本盘;削减免费额度,可能冲击C端口碑;等待乌兰察布数据中心交付,但数据中心建设以年计,短期难以缓解。
也需要冷静看待。此次故障持续时间短、已恢复,官方未披露原因,“算力过载”是基于长期模式的合理推断,并非官方定性,也不排除发版或网络波动等因素——DeepSeek Harness正处于两天一更的高频迭代期。此外,服务波动在国产大模型圈并不罕见:Kimi K3发布后48小时请求量触及集群极限,一度暂停新用户订阅;智谱年内也已三次涨价。算力紧张是全行业共同面对的背景。
把这次“服务器繁忙”与近期涨价放在一起看,DeepSeek今年的主线较为清晰:技术口碑带来的流量洪峰,正持续冲击算力堤坝。对用户而言,“价格屠夫”的标签正在让位于供需规律。梁文锋曾表示,定价目标是十个月收回设备成本,价格再翻一倍,token消耗量区别不大。这反过来意味着,在算力追上需求之前,间歇性的“服务器繁忙”可能成为常态。真正的变量不在价格表里,而在乌兰察布的机架上。