最高涨 1100%!DeepSeek 新定价今日生效,大模型 API 进入「峰谷电价」时代
8 月 17 日零时起,DeepSeek 正式执行新版 API 价格。两款主力模型首次引入峰谷分时定价,闲时价格统一为高峰时段的五折。综合模型、Token 类型与调用时段,本轮价格涨幅介于 50% 至 1100%。
8 月 17 日零时起,DeepSeek 正式执行新版 API 价格。两款主力模型首次引入峰谷分时定价,闲时价格统一为高峰时段的五折。综合模型、Token 类型与调用时段,本轮价格涨幅介于 50% 至 1100%。
DeepSeek 将北京时间每日划分为高峰与闲时两个时段。高峰共 7 小时,闲时 17 小时,闲时价格统一按高峰价的五折计算。
注:高峰时段为每日 9:00–12:00 及 14:00–18:00(含午休间隔),共 7 小时;其余 17 小时均为闲时。时间轴按 24 小时等比例缩放。
对开发者而言,批量数据处理、代码生成、模型评测等对响应时间要求较低的任务,可以通过错峰调用显著降低成本。
以定位更高的 DeepSeek-V4-Pro 为例,本轮调整并非简单翻倍——不同 Token 类型涨幅差异巨大。
| Token 类型 | 原价(元/百万) | 新价·高峰 | 新价·闲时 |
|---|---|---|---|
| 缓存命中输入 | 0.025 | 0.3 ↑1100% | 0.15 5折 |
| 缓存未命中输入 | 3 | 9 ↑200% | 4.5 5折 |
| 输出 | 6 | 27 ↑350% | 13.5 5折 |
注:价格为每百万 Tokens 人民币。闲时段三项涨幅分别为 500%、50%、125%。V4-Flash 同步涨价,涨幅区间为 50%–400%。
数据只是故事的一部分。
真正值得关注的,不是绝对数字,而是涨幅结构的非对称性——缓存命中输入从 0.025 元涨到 0.3 元,涨幅达 1100%;而闲时段的缓存未命中输入仅从 3 元涨到 4.5 元,涨幅 50%。
将两款模型的高峰时段涨幅放在一起看,趋势更清晰:
注:柱形以最高涨幅 1100% 为满刻度等比缩放,非零起点。仅展示高峰时段涨幅;闲时涨幅分别为 500%/150%、125%、50%。
8 月 13 日,DeepSeek 同日公布新价格并推出 DeepSeek-V4-Pro 正式版(编号 V4-Pro-0813)。两款模型在能力与并发上限上差异明显。
注:V4-Pro 支持思考与非思考两种模式。两款模型均于 8 月 17 日零时起执行新价。
价格杠杆的实质,是让开发者重新审视任务调度策略。不同业务类型的成本弹性差异巨大。
模型推理需要持续占用 AI 算力。工作时段的企业及开发者请求更集中,闲时则可能出现资源利用率下降。DeepSeek 通过价格杠杆引导用户错峰,可以提高智算集群利用率,并缓解高峰期服务压力。
从曾经依靠低价迅速打开市场,到如今按算力供需分时计价,DeepSeek 的 API 生意开始出现类似「峰谷电价」的运行逻辑。
一个诚实的注脚:基础价格大幅上调,也意味着「低价时代」的阶段性终结。
缓存命中率、请求编排和调用时间,正成为控制大模型使用成本的新变量。随着 Token 调用规模继续增长,大模型价格战正在进入更精细的 2.0 阶段。
大模型 API 正在从「统一标价」走向「算力供需定价」——谁掌握了任务调度与错峰能力,谁就掌握了下一轮成本竞争的主动权。
但这也意味着,DeepSeek 曾经最锋利的武器——极致低价——正在被主动收鞘。对依赖其低价红利的初创团队,迁移成本与重新定价的压力已不可忽视。
DeepSeek-V4-Flash 与 V4-Pro 新版 API 已于 8 月 17 日零时正式生效,开发者可在官方平台查看完整价格表与并发限制。
platform.deepseek.com → 查看最新定价