💰 定价策略 · 行业风向

DeepSeek告别"地板价":峰谷定价上线,API最高涨价11倍

8月17日,DeepSeek正式引入峰谷定价机制,高峰时段价格翻倍。曾经以"价格屠夫"姿态横扫市场的国产大模型,在算力紧张与行业价值回归的双重压力下,开始调整价格策略。曾经把API价格打到"地板"的玩家,如今主动抬高了门槛。

综合公开信息整理 2026-08-18 全文约 3 分钟读完
#DeepSeek #API定价 #峰谷机制 #大模型商业化
1100% V4-Pro 输入缓存命中高峰涨幅
11.2 万亿 V4-Flash 周调用量 Token 数
48-80% 行业平均 API 价格同比涨幅

⚡ 30 秒速览

  • 涨价幅度:高峰时段价格翻倍,V4-Pro 输入缓存命中场景涨幅达 1100%,创下国产大模型单次调价幅度纪录。
  • 定价机制:引入峰谷定价,高峰时段为 9:00-12:00 及 14:00-18:00,其余时间为空闲时段,鼓励错峰使用。
  • 行业背景:2026年Q2中国大模型平均 API 输入价格同比上涨 48%,输出价格上涨 80%,智谱、月之暗面等头部厂商年内均已提价。
  • 历史坐标:DeepSeek 曾以"价格屠夫"策略横扫市场,V4-Flash 周调用量连续登顶全球,峰值达 11.2 万亿 Token
  • 深层信号:算力供需缺口持续拉大(需求增速 417% vs 供给增速 128%),行业正从价格竞争转向价值竞争。

01峰谷定价 不是简单涨价,是精细化的价格杠杆

涨价不是简单的"一刀切"。DeepSeek 这次选择了一种更精细化的方式——峰谷定价,将一天划分为高峰和空闲两个时段,价格相差一倍。

空闲时段

高峰以外时段,价格维持调价后基准价。V4-Pro 输出 13.5 元/百万 Tokens,输入缓存命中 0.15 元/百万 Tokens。

高峰时段(9:00-12:00 / 14:00-18:00)

所有价格翻倍。V4-Pro 输出 27 元/百万 Tokens,输入缓存命中 0.3 元/百万 Tokens,涨幅最高达 1100%。

以 V4-Pro 为例,涨价前后的价格变化在高峰时段尤为剧烈:

0.025→0.3输入缓存命中(元/百万Tokens)
3→9输入缓存未命中(元/百万Tokens)
6→27输出价格(元/百万Tokens)
1100%输入缓存命中涨幅

注:箭头左侧为涨价前价格,右侧为高峰时段价格。输入缓存命中场景涨幅最大,主要因为此前该场景享有极低优惠价。

DeepSeek 表示,峰谷定价的目的是"更合理地调配资源,鼓励用户根据实际使用情况调整任务时间"。

02行业集体转向 涨价不是孤例,全行业都在"收刀"

DeepSeek 的涨价并非孤例。整个国产大模型赛道,正在经历一场集体转向

摩根士丹利 8 月发布的研报显示,2026 年第二季度,中国大模型平均 API 价格已全面攀升:

2026 Q2 平均输入价格每百万 Tokens
4.9 元
2025 Q1 平均输入价格每百万 Tokens
3.3 元
2026 Q2 平均输出价格每百万 Tokens
21.9 元
2025 Q1 平均输出价格每百万 Tokens
12.2 元

注:柱形自 0 元起显示,宽度反映价格相对关系。输入价格同比上涨约 48%,输出价格同比上涨约 80%。

头部厂商动作更为明显:智谱年内已三次提价;月之暗面随 Kimi K3 发布,API 输入价格涨幅超 3 倍、输出价格涨幅接近 4 倍。

但一个诚实的注脚:即便大幅调价后,DeepSeek 的价格相比海外同行仍具竞争力。

Claude 旗舰模型

输出价格约 350 元/百万 Tokens(按国盛证券测算口径)

DeepSeek V4-Pro 高峰时段

输出价格 27 元/百万 Tokens,约为 Claude 的 1/13

03"价格屠夫"的崛起之路 从 V3 到 V4,性价比如何改写格局

但就在几个月前,DeepSeek 还是那个让对手颤抖的"价格屠夫"。

2024 年底,DeepSeek-V3 以极低的训练成本实现媲美 GPT-4o 的性能,震撼行业。随后发布的 R1,输出 API 价格仅为 OpenAI o1 的 3%。今年 4 月,V4 系列发布,全系输入缓存命中价格降至首发价的 1/10,V4-Pro 更叠加限时 2.5 折,百万 Tokens 输入缓存命中低至 0.025 元,创下全球大模型价格新低。

低价策略直接推动了调用量的爆发式增长。OpenRouter 数据显示,V4-Flash 的周调用量连续登顶全球:

7.22 万亿7月27日-8月2日
8.83 万亿8月3日-8月9日
11.2 万亿8月10日-8月16日
#1连续三周全球第一

注:数据来自 OpenRouter 全球模型调用量周榜。V4-Flash 正式版于 7月31日上线公测,此后两周调用量持续攀升。

价低并不意味着"物廉"。官方测评显示,V4-Pro 正式版在 Terminal Bench 2.1、Cybergym、DeepSWE 等多个测试项目中均领先于 Opus-4.8,部分项目甚至优于 Fable5。

📉 "DeepSeek 斩杀线"——一个源自性价比散点图的新词 行业热词

  • 来源:Artificial Analysis 绘制的模型性价比散点图,横轴为单次任务成本,纵轴为智能指数得分。
  • 含义:DeepSeek-V4-Flash 所在的点位形成了一条"斩杀线"——性能在同一梯队但定价明显更高的,或性能不如它但价格更贵的,通通被划入"斩杀区"。
  • 行业影响:这个词汇的流行,折射出市场对"极致性价比"的强烈认同,也给其他厂商带来了定价压力。
一个侧面印证:用户用脚投票,性价比依然是现阶段最硬的竞争力

04为什么放下"价格屠刀"? 算力账本与行业拐点

答案藏在算力账本里。

DeepSeek 服务器承压的信号早已出现。8 月 4 日,海外开源 AI Coding Agent 平台 OpenCode 发文称,V4-Flash 因前所未有的访问量出现容量不足问题,引发报错。当天上午,部分用户反馈官方 API 几乎不可用。

这背后是算力资源紧张的严峻现实。据中国发展高层论坛 2026 年年会披露,今年 3 月中国日均 Token 调用量突破 140 万亿,两年增长超千倍。然而供给端远未跟上:

417%AI算力需求同比增长
128%有效供给增速
持续扩大供需缺口
供不应求高端GPU/HBM显存

注:数据来自中国信通院 2026 年一季度报告。供需缺口持续拉大是行业性挑战,并非 DeepSeek 一家独有。

受制于算力紧缺,月之暗面此前已在 Kimi K3 爆火后宣布暂停 C 端新用户订阅,将算力全部投入已有用户。DeepSeek 选择涨价来调节需求,本质上是一样的逻辑——用价格杠杆缓解供给压力,同时为下一轮研发储备资金

摩根士丹利在研报中指出,中国大模型行业正在建立更加健康的商业化环境,竞争重点从价格转向模型能力。前沿模型能力提升需要大量训练及算力投入,单纯依靠低价争夺市场会压低产品毛利,进而限制下一代模型所需的研发资金。涨价,某种程度上是"为了明天能继续参赛"。

编辑核心判断

价格战退潮不是行业降温,而是竞争进入更深水区的信号。当"价格屠夫"主动收刀,说明靠补贴换规模的阶段已经过去,接下来比拼的是谁能在合理的商业回报与持续的技术投入之间找到平衡。这场涨价潮的真正含义是:国产大模型正在从"烧钱抢用户"转向"赚钱养研发"。

了解最新定价

DeepSeek 新版 API 定价已正式生效,峰谷时段价格详情可访问官网查询。

deepseek.com → 查看定价详情