• Like
  • Comment
  • Favorite

Deepseek官宣降价!缓存命中单价0.02元、未命中1元,价差50倍

华尔街见闻09-09 17:27

DeepSeek再度调整API定价策略,这次并非简单的全面降价,而是将降价重点放在“缓存命中”上,同时引入高峰、空闲时段差异化计费,进一步瞄准高频调用和长上下文场景。

根据DeepSeek开放平台公告,Flash系列将于北京时间2026年9月10日12:00起实施新定价。空闲时段输入缓存命中单价降至0.02元/千token,缓存未命中单价为1元,二者价差达到50倍;输出单价为4元。高峰时段(北京时间周一至周五9:00-12:00、14:00-18:00)各项价格均为闲时的2倍。

这意味着,对于能够反复复用相同上下文的应用,API成本可能出现明显下降。简单来说,所谓“缓存命中”,就是模型此前已经处理过的一部分内容,在后续请求中无需重新完整计算,系统可以直接复用相关结果。对于长提示词、固定系统指令或持续对话等场景,这部分内容往往占据输入token的大头,因此缓存命中率越高,降本效果越明显。

新定价结构:让价格跟着使用方式走

此次调整最明显的变化,是API价格不再只由调用量决定,而是与调用时间和内容是否重复同时挂钩。

对于开发者而言,这意味着同样调用100万token,如果大部分内容能够被缓存,成本可能远低于每次都重新输入。尤其是RAG、代码助手、客服机器人、Agent等应用,往往存在大量重复的系统指令、知识库和历史上下文,更容易从这一机制中受益。

这也会改变开发者的成本优化方式。过去主要是选择更便宜的模型、减少token消耗;现在则可以进一步通过固定上下文、拆分动态内容等方式提高缓存命中率。换言之,API成本管理开始从“少用token”延伸到“让token尽可能复用”。

降价背后:既抢用户,也调算力

从平台角度看,缓存和时段优惠并不只是给用户“打折”,背后还有明显的算力调度逻辑。

缓存命中意味着部分输入无需重复计算,可以降低相同请求反复处理带来的算力消耗;而闲时折扣则是在价格层面鼓励用户错峰,把部分非实时任务从工作日高峰转移出去。两者结合,本质上都是在提高有限算力资源的利用效率。

对于DeepSeek而言,这种模式还有另一层意义:它重点优惠的是能够形成稳定、高频调用的用户,而不是无差别降低所有请求的价格。RAG、代码助手、客服和Agent等应用一旦建立在API之上,迁移成本通常也会随着调用量和业务深度增加,因此这类用户的长期价值更高。

Disclaimer: Investing carries risk. This is not financial advice. The above content should not be regarded as an offer, recommendation, or solicitation on acquiring or disposing of any financial products, any associated discussions, comments, or posts by author or other users should not be considered as such either. It is solely for general information purpose only, which does not consider your own investment objectives, financial situations or needs. TTM assumes no responsibility or warranty for the accuracy and completeness of the information, investors should do their own research and may seek professional advice before investing.

Report

Comment

empty
No comments yet
 
 
 
 

Most Discussed

 
 
 
 
 

7x24