💰 商业 · 定价变革

最高涨 1100%!DeepSeek 新定价今日生效,大模型 API 进入「峰谷电价」时代

8 月 17 日零时起,DeepSeek 正式执行新版 API 价格。两款主力模型首次引入峰谷分时定价,闲时价格统一为高峰时段的五折。综合模型、Token 类型与调用时段,本轮价格涨幅介于 50% 至 1100%

综合公开信息整理 2025-08-17 全文约 3 分钟读完
#DeepSeek #API定价 #峰谷电价 #大模型商业化
1100% 最高涨幅 · V4-Pro 缓存命中输入(高峰)
5 闲时价格统一为高峰时段的一半
7h 每日高峰时段,其余 17 小时为闲时

⚡ 30 秒速览

  • 谁涨了:DeepSeek-V4-Flash 与 DeepSeek-V4-Pro 两款主力模型,基础价格全面上调。
  • 怎么涨:首次采用峰谷定价——高峰 7 小时执行全价,闲时 17 小时统一五折。
  • 涨多少:涨幅区间 50%–1100%,缓存命中输入涨幅最猛,输出价格涨幅相对温和。
  • 为什么:用价格杠杆引导错峰调用,提高智算集群利用率,缓解高峰服务压力。
  • 新变量:任务调度、缓存命中率、调用时间,正成为控制大模型成本的关键杠杆。

01一天 24 小时怎么分?峰谷时段划分

DeepSeek 将北京时间每日划分为高峰闲时两个时段。高峰共 7 小时,闲时 17 小时,闲时价格统一按高峰价的五折计算。

高峰 7h
闲时 17h
00:0009:0012:0014:0018:0024:00

注:高峰时段为每日 9:00–12:00 及 14:00–18:00(含午休间隔),共 7 小时;其余 17 小时均为闲时。时间轴按 24 小时等比例缩放。

对开发者而言,批量数据处理、代码生成、模型评测等对响应时间要求较低的任务,可以通过错峰调用显著降低成本。

02涨了多少?V4-Pro 新旧价格全对比

以定位更高的 DeepSeek-V4-Pro 为例,本轮调整并非简单翻倍——不同 Token 类型涨幅差异巨大。

Token 类型 原价(元/百万) 新价·高峰 新价·闲时
缓存命中输入 0.025 0.3 ↑1100% 0.15 5折
缓存未命中输入 3 9 ↑200% 4.5 5折
输出 6 27 ↑350% 13.5 5折

注:价格为每百万 Tokens 人民币。闲时段三项涨幅分别为 500%、50%、125%。V4-Flash 同步涨价,涨幅区间为 50%–400%。

数据只是故事的一部分。

真正值得关注的,不是绝对数字,而是涨幅结构的非对称性——缓存命中输入从 0.025 元涨到 0.3 元,涨幅达 1100%;而闲时段的缓存未命中输入仅从 3 元涨到 4.5 元,涨幅 50%。

03涨幅全景 两款模型 · 六项价格

将两款模型的高峰时段涨幅放在一起看,趋势更清晰:

V4-Pro 缓存命中0.025→0.3
1100%
V4-Flash 缓存命中0.02→0.1
400%
V4-Pro 输出6→27
350%
V4-Flash 输出2→9
350%
V4-Pro 未命中输入3→9
200%
V4-Flash 未命中输入1→3
200%

注:柱形以最高涨幅 1100% 为满刻度等比缩放,非零起点。仅展示高峰时段涨幅;闲时涨幅分别为 500%/150%、125%、50%。

04两款模型,两种定位V4-Flash vs V4-Pro

8 月 13 日,DeepSeek 同日公布新价格并推出 DeepSeek-V4-Pro 正式版(编号 V4-Pro-0813)。两款模型在能力与并发上限上差异明显。

⚡ V4-Flash

高吞吐 · 轻量调用场景
  • 高峰输出价 9 元/百万 Tokens
  • API 并发上限 2500 路
  • 更适合高吞吐调用场景

🧠 V4-Pro

深度推理 · 复杂任务场景
  • 高峰输出价 27 元/百万 Tokens
  • API 并发上限 500 路
  • 支持 100 万 Tokens 上下文
  • 最高 384K Tokens 输出长度
  • 原生支持工具调用与 Anthropic API

注:V4-Pro 支持思考与非思考两种模式。两款模型均于 8 月 17 日零时起执行新价。

05你的 Token 账单会怎样变?两类场景的影响

价格杠杆的实质,是让开发者重新审视任务调度策略。不同业务类型的成本弹性差异巨大。

🔴 实时对话 / 在线 Agent难以避峰

  • 用户请求集中在工作时段,几乎无法避开高峰价格
  • 此类业务将直接承受最高涨幅,缓存命中输入成本最高涨 11 倍
  • 优化空间有限,只能通过提高缓存命中率部分对冲。
核心影响:实时型业务的 Token 账单将明显变厚,产品定价模型可能需要同步调整。

🔵 离线分析 / 批量翻译 / 夜间评测错峰空间大

  • 对响应时间要求低,可主动安排在闲时执行,价格直接五折。
  • 数据清洗、批量翻译、模型评测等任务天然适合夜间运行。
  • 通过请求编排调用时间管理,可有效控制总成本。
核心影响:离线型业务拥有更大的成本优化空间,任务调度能力将成为开发者的新竞争力。

06为什么是现在?从低价抢市场到分时算力调度

模型推理需要持续占用 AI 算力。工作时段的企业及开发者请求更集中,闲时则可能出现资源利用率下降。DeepSeek 通过价格杠杆引导用户错峰,可以提高智算集群利用率,并缓解高峰期服务压力。

从曾经依靠低价迅速打开市场,到如今按算力供需分时计价,DeepSeek 的 API 生意开始出现类似「峰谷电价」的运行逻辑。

一个诚实的注脚:基础价格大幅上调,也意味着「低价时代」的阶段性终结。

缓存命中率、请求编排和调用时间,正成为控制大模型使用成本的新变量。随着 Token 调用规模继续增长,大模型价格战正在进入更精细的 2.0 阶段

编辑核心判断

大模型 API 正在从「统一标价」走向「算力供需定价」——谁掌握了任务调度与错峰能力,谁就掌握了下一轮成本竞争的主动权。

但这也意味着,DeepSeek 曾经最锋利的武器——极致低价——正在被主动收鞘。对依赖其低价红利的初创团队,迁移成本与重新定价的压力已不可忽视。

现在就能用

DeepSeek-V4-Flash 与 V4-Pro 新版 API 已于 8 月 17 日零时正式生效,开发者可在官方平台查看完整价格表与并发限制。

platform.deepseek.com → 查看最新定价