今日(北京时间 2026.8.17 00:00)起,DeepSeek API 正式切换到峰谷定价模式。高峰时段价格翻倍,空闲时段价格为高峰时段价格的一半。这是 DeepSeek V4 系列模型发布后最大的价格动作。

到底涨了多少
新定价覆盖两个主力模型:DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。高峰时段为北京时间 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。
以 V4-Pro 为例,高峰时间段每百万 tokens 输入(缓存未命中)9 元(涨幅 200%)、输出 27 元(涨幅 350%),缓存命中输入 0.3 元(涨幅 1100%)。空闲时间段,V4 Pro 每百万 tokens 输入(缓存未命中)4.5 元、输出 13.5 元,缓存命中输入低至 0.15 元。以此看来,V4 Pro 高峰时间段涨幅最高达 1100%。
这套定价策略其实早在 6 月底就有预告。DeepSeek 官方在 8 月 13 日的 V4 Pro GA 公告中正式确认了新的定价策略。

峰谷定价的行业意涵
大模型 API 供应商做峰谷定价,在此前几乎没有先例。OpenAI、Anthropic 至今是统一定价。
峰谷定价的底层逻辑和云计算如出一辙:算力在峰时稀缺、谷时空闲。通过价格信号引导用户把批处理、离线分析等非实时任务移到谷时,能提高整体资源利用率。考虑到 DeepSeek 的 GPU 供给受出口管制影响,资源优化可能比竞争对手更紧迫。
但开发者端的体感是另一回事。一位用户说,他见过很多公司一开始只用 DeepSeek,等团队涨到 150 人、开始按 API 用量付费之后,「立刻开始引入其他模型」。在价格敏感的用户群中推行高峰涨价,是一把双刃剑。
更大的背景:V4 Pro GA
峰谷定价是 V4 系列正式发布的一部分。DeepSeek-V4-Pro 于 8 月 13 日进入 GA,支持 1M 上下文窗口、384K 最大输出、灵活推理力度(low/high/max),原生支持 OpenAI Responses API。V4-Flash 则在 7 月底更新至 0731 版本。
两个模型均保持旧版调用方式不变——用 deepseek-v4-flash 或 deepseek-v4-pro 作为 model name 即自动指向最新版本。
参考来源: