DeepSeek 缓存涨价 11 倍:长上下文需求暴涨,存储税时代来临
原标题:DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
AI 摘要
DeepSeek 于 8 月 17 日上调 V4 Pro API 价格,其中缓存命中价格在高峰时段涨幅高达 11 倍,从 0.025 元/百万 Token 涨至 0.3 元/百万 Token。涨价原因是长上下文需求激增导致后端缓存颠簸,存储、IO 和调度成本上升。文章分析了 DeepSeek 的 KV 压缩和冷热分层技术,并对比了 Anthropic 和 OpenAI 的应对策略,指出开发者需优化缓存命中率以降低成本。
正文节选
0 作者丨高允毅 编辑丨岑 峰 一直以来,DeepSeek都是白菜价的代名词,这次它开始涨价了,而且还按时间段收钱。 8 月 17 日,DeepSeek V4 Pro API 的输入和输出价格涨幅如下图。其中,最便宜的缓存命中价格在空闲时断直接涨了5倍,在高峰时期,它竟然涨了11倍,从0.025 元 / 百万Token 涨至 0.3 元/ 百万 Token。 很多人或许并不了解“缓存命中”是什么。简单理解,它就像大模型的“草稿纸”,AI 每次回答问题时,不必每次都去重新翻阅所有信息。只要它之前计算过一次,这段长文本就会以“KV单元”的形式沉淀在存储集群里,后续调用直接提取即可。 一直以来,极高的缓存命中率是DeepSeeek最出圈的“性价比杀器”,它依靠极致的KV压缩技术和冷热记忆分层搬运架构,直接省掉了这部分海量的重复计算,把长文本的调用门槛控制到可以忽略不计。 正因如此,无数市面上的代码助手、知识库 Agent、长文档分析这样有着超长上下文的产品,通过薅DeepSeek的羊毛撑起了自己的盈利模型。而过大的需求量也直接把低廉的缓存命中变成了厂商不堪重负的刚性开销。 大模型的成本结构,