周日闲时也“服务器繁忙”:DeepSeek的算力底账,快兜不住了
本文来自微信公众号: AI唱反调 ,作者:白壳
周日傍晚五点,闲时时段,DeepSeek又"繁忙"了。
昨天下午,不少网友发现,往DeepSeek里输入问题,等来的只有一句"服务器繁忙,请稍后重试"——深度思考、联网搜索的开关怎么切都没用。好在这次崩得短,没多久就恢复了。

但有个细节值得咂摸:按DeepSeek自己的峰谷定价,高峰时段是工作日早上9点到12点、下午2点到6点。周日傍晚,本该是算力最松的时候。
闲时都扛不住,这事就比故障本身有意思了。
DeepSeek周日闲时突发"服务器繁忙"。今年它已经不是第一次崩:5月一个月崩四回、8月V4-Flash被流量打到性能下降。底牌是约2万张H系列芯片训练推理共用,自家数据中心还没建好。
又崩了,这回还是闲时
先把事说清楚。
昨天(9月20日)下午,三言科技实测发现DeepSeek服务异常:问题发出去,回来的只有"服务器繁忙",两个功能开关都成了摆设。之后服务恢复,截至发稿,官方没有出来说明。
单次故障不算新闻,可放进时间线里,画风就不一样了:
5月,一个月连崩四次。事后有人算了笔账——用户量暴涨66.7%,算力储备只涨了8.3%,缺口就是这么拉开的。7月中旬到8月初,V4正式版灰度期间服务频繁抽风,开发者社区甚至靠"API还答不答得对新题"来反推灰度进度。8月4日,V4-Flash被"前所未有的访问量"打到性能下降,官方确认后修复。
然后,就是昨天。周日,傍晚,闲时,又忙了。
两万张卡,训练推理一起抢
DeepSeek为什么老是扛不住?公开信息能拼出一张算力底账。
据公开报道,DeepSeek手里大约有2万张H系列等效芯片,训练和推理还在同一个池子里抢资源;自建的乌兰察布智算中心没完全交付。从4月开始,公司密集招数据中心运维、交付、IDC设计规划的工程师——基建补课的痕迹,藏都藏不住。
需求侧的膨胀,完全是另一个量级。OpenCode平台数据显示,8月1日V4-Flash单日处理8万亿token,其中5万亿来自免费试用额度;OpenRouter周榜上,它一周被调用8.83万亿token,环比暴涨570%——一个模型顶了小半个平台。
供需这笔账,画出来长这样:

回看今年6月以来的每一轮调价——峰谷定价、官宣"涨幅较大"、高峰价翻倍、V4-Pro高峰输出从6元涨到27元——说白了都是同一件事换了种说法:算力不够,涨价来凑。梁文锋7月在投资者交流会上的原话就很实在:"以合理的价格尽可能多地买显卡,中美之间的AI差距主要是算力资源的差距。"
价格的招快出完了,然后呢
麻烦在于,价格这个工具箱,快见底了。
峰谷定价、缓存折扣、周末低谷价、全线涨价——半年时间,负载管理的招式基本用了个遍。涨价确实筛掉了一批无效流量,可8万亿日调用量里那5万亿免费额度摆在那,白嫖流量依然是最大的算力黑洞。
往后看,路其实就三条。接着涨价?8月这波之后,V4-Flash高峰时段对OpenAI Luna的价格优势已经基本磨平,再涨就要动基本盘了。砍免费额度?C端口碑得崩。等乌兰察布交付?数据中心以年计,远水解不了近渴。
昨天下午这次"繁忙",像个不大不小的注脚:闲时都顶不住,说明负载水位已经贴着日常容量的天花板走了——出问题的地方不是峰值,是日常。
泼几盆冷水
冷静的部分也得说。
这次故障持续时间短、已经恢复,官方没披露原因,"算力过载"是我们基于长期模式的合理推断,不是官方定性——说不定只是发版手滑、网络抖了一下,毕竟DeepSeek Harness正在两天一更的高频迭代期,工程上折腾出点动静很正常。再退一步讲,崩这个事在国产大模型圈也不稀奇:Kimi K3发布后48小时请求量顶到集群极限,只能暂停新用户订阅;智谱年内涨了三次价。算力紧是全行业的背景板,不是哪一家的丑事。
结尾
把昨天这次"服务器繁忙"和最近的涨价放一起看,DeepSeek今年的故事线其实很统一:技术口碑引来的流量洪水,正在一波波漫过算力的堤坝。
对用户来说,"价格屠夫"的人设正在让位于"供需规律"。梁文锋自己也讲得明白:定价目标是十个月收回设备成本,"价格再翻一倍,token消耗量区别不大"。这话反过来听就是——算力追不上需求之前,隔三差五的"服务器繁忙",怕是会成为日常。
真正的解药不在价格表里,在乌兰察布的机架上。那座数据中心什么时候亮灯,这出"繁忙"连续剧什么时候才算剧终。