Deepseek官宣降价
2026-09-09 03:25:10 · chineseheadlinenews.com · 来源: 华尔街日报
DeepSeek将于9月10日调整API定价,重点优惠缓存命中场景:闲时命中价0.02元/千token,未命中价1元,价差50倍。新策略鼓励开发者提高上下文复用率,降低长文本、高频调用成本,同时引导错峰使用以优化算力效率,重点吸引RAG、代码助手等高粘性用户。
DeepSeek再度调整API定价策略,这次并非简单的全面降价,而是将降价重点放在“缓存命中”上,同时引入高峰、空闲时段差异化计费,进一步瞄准高频调用和长上下文场景。
根据DeepSeek开放平台公告,Flash系列将于北京时间2026年9月10日12:00起实施新定价。空闲时段输入缓存命中单价降至0.02元/千token,缓存未命中单价为1元,二者价差达到50倍;输出单价为4元。高峰时段(北京时间周一至周五9:00-12:00、14:00-18:00)各项价格均为闲时的2倍。
这意味着,对于能够反复复用相同上下文的应用,API成本可能出现明显下降。简单来说,所谓“缓存命中”,就是模型此前已经处理过的一部分内容,在后续请求中无需重新完整计算,系统可以直接复用相关结果。对于长提示词、固定系统指令或持续对话等场景,这部分内容往往占据输入token的大头,因此缓存命中率越高,降本效果越明显。
新定价结构:让价格跟着使用方式走
此次调整最明显的变化,是API价格不再只由调用量决定,而是与调用时间和内容是否重复同时挂钩。
对于开发者而言,这意味着同样调用100万token,如果大部分内容能够被缓存,成本可能远低于每次都重新输入。尤其是RAG、代码助手、客服机器人、Agent等应用,往往存在大量重复的系统指令、知识库和历史上下文,更容易从这一机制中受益。
这也会改变开发者的成本优化方式。过去主要是选择更便宜的模型、减少token消耗;现在则可以进一步通过固定上下文、拆分动态内容等方式提高缓存命中率。换言之,API成本管理开始从“少用token”延伸到“让token尽可能复用”。
降价背后:既抢用户,也调算力
从平台角度看,缓存和时段优惠并不只是给用户“打折”,背后还有明显的算力调度逻辑。
缓存命中意味着部分输入无需重复计算,可以降低相同请求反复处理带来的算力消耗;而闲时折扣则是在价格层面鼓励用户错峰,把部分非实时任务从工作日高峰转移出去。两者结合,本质上都是在提高有限算力资源的利用效率。
对于DeepSeek而言,这种模式还有另一层意义:它重点优惠的是能够形成稳定、高频调用的用户,而不是无差别降低所有请求的价格。RAG、代码助手、客服和Agent等应用一旦建立在API之上,迁移成本通常也会随着调用量和业务深度增加,因此这类用户的长期价值更高。