自北京时间 2026 年 8 月 17 日 0 时起,DeepSeek API 对 deepseek-v4-pro 与 deepseek-v4-flash 两个模型执行峰谷定价,闲时价格为高峰时段价格的一半。这意味着在非高峰时段调度批量或离线任务,调用成本可比高峰时段降低 50%。该价格调整随 DeepSeek V4 全系列模型正式版上线而公布,于今日凌晨正式生效。
定价结构与高峰时段
按照官方价格表,高峰时段为北京时间每日 9:00–12:00 与 14:00–18:00,其余时间为闲时时段,闲时价格统一为高峰价格的一半。价格按百万 token 计费,输入区分缓存命中与缓存未命中,输出单独计费。
- deepseek-v4-pro:输入(缓存命中)闲时 0.15 元、高峰 0.30 元;输入(缓存未命中)闲时 4.5 元、高峰 9.0 元;输出闲时 13.5 元、高峰 27.0 元(均为每百万 token)。
- deepseek-v4-flash:输入(缓存命中)闲时 0.05 元、高峰 0.10 元;输入(缓存未命中)闲时 1.5 元、高峰 3.0 元;输出闲时 4.5 元、高峰 9.0 元(均为每百万 token)。
背景与可用范围
该峰谷定价由深度求索于 8 月 13 日随 DeepSeek-V4-Pro 正式版上线一并公布,新价格于 2026 年 8 月 17 日 0 时(北京时间)开始生效。V4-Pro 正式版与 V4-Flash 均已上线 APP、网页端与 API,两模型支持 1M 上下文、最大 384K 输出,并原生支持 Responses API 及 Codex 适配。
需要注意:本文所述为 DeepSeek API 官方公布的计价与限制,实际扣费以官方价格页与账户账单为准,DeepSeek 保留修改价格的权利。对在中国调用 DeepSeek API 的开发者而言,把长任务、批量推理或离线处理安排在闲时时段,可显著摊薄调用成本。