2026年8月22日,DeepSeek 官方 API 价格文档新增周末计费调整:从北京时间2026年8月23日零点起,周六、周日全天不再区分峰谷,统一按照低谷时段价格收取调用费用。工作日的高峰和低谷规则并未取消。
这次变化直接影响使用 DeepSeek 官方 API 的开发者,尤其是可以延后执行的批量生成、离线评测、数据清洗和智能体回放任务。低谷价仍为高峰价的一半,因此把非紧急负载安排到周末,会比在工作日高峰运行更容易控制成本。
哪些价格会按周末低谷档计算
官方文档列出的三个模型都适用新规则,包括 deepseek-v4-flash、deepseek-v4-pro 和实验性的 deepseek-v4-flash-vision-exp。以人民币计价为例,Flash 的百万 token 缓存命中输入为低谷 0.05 元、高峰 0.10 元;缓存未命中输入为 1.5 元和 3 元;输出为 4.5 元和 9 元。Pro 对应的低谷价分别为 0.15 元、4.5 元和 13.5 元。
周末统一低谷价后,上述较低一档会全天生效。但新规从周日零点开始,因此首个生效日是2026年8月23日;从之后的完整周末起,周六和周日都按低谷档执行。
工作日北京时间 9:00 至 12:00、14:00 至 18:00 仍属于高峰时段,其余工作日时段才使用低谷价。模型版本、上下文长度和并发上限也没有因这次计费规则调整而改变。调用方若不区分任务优先级,工作日高峰的成本仍会保持原档。
另一个容易误解的地方是,低谷价只改变单价,不会减少实际 token 消耗。长上下文、低缓存命中率和过长输出仍可能让总费用上升。成本控制应同时关注缓存命中、输入裁剪、最大输出长度和失败重试,而不是只移动执行时间。
调度系统可以怎样利用新规则
对有任务队列的平台,可以把实时对话继续放在即时队列,把不要求立刻返回的评测、摘要重算和内容索引标记为周末批任务。计费统计也应按模型、缓存命中状态和输入输出分别记录,否则很难确认节省来自价格时段,还是来自 token 使用变化。
DeepSeek 这次调整给开发者增加了一个稳定的周末成本窗口。它对持续在线的交互产品帮助有限,却能明显改善可调度计算的预算确定性;是否真正省钱,最终仍取决于任务能否被安全地延后,以及团队是否有清晰的用量监控。