💸 商业 · 定价观察
缓存命中涨价 12 倍、高峰翻倍闲时五折:大模型 API 正在集体告别「地板价」
DeepSeek 官宣「算力峰谷分级计价」,V4-Pro 高峰时段输出价冲到 27 元/百万 tokens,缓存命中输入价一夜之间从 0.025 元涨到 0.3 元。从豆包到 Kimi,从腾讯云到智谱,B 端 API 价格正在集体起飞——那个「随便调、不要钱」的 AI 乌托邦,开始退潮了。
综合公开信息整理•
事件时间 2026-03 至 2026-08•
全文约 4 分钟读完
#DeepSeek
#API定价
#峰谷计价
#商业化拐点
12 ×
缓存命中输入价涨幅 · 0.025元→0.3元/百万tokens
4.5 ×
V4-Pro 高峰输出价涨幅 · 27元/百万tokens
5 折
闲时价格 · 仅为高峰价的一半
⚡ 30 秒速览
- 发生了什么:DeepSeek 推出「算力峰谷分级计价」,高峰全价、闲时半价;缓存命中输入价从 0.025 元涨到 0.3 元,翻了 12 倍。
- 不是孤例:豆包、Kimi、腾讯云、智谱、MiniMax 年内先后调价,B 端 API 价格普遍进入上升通道。
- 直接原因:生成式 AI 每次调用都在烧 GPU、烧电、烧钱;低价还引来爬虫等无效请求,挤占高价值客户算力。
- 深层机制:「峰谷电价」借鉴电力行业削峰填谷,用价格杠杆把白天拥堵请求「赶」到夜间,省下扩容 GPU 集群的巨额开支。
- 历史坐标:263 邮箱、网盘大战、Meta 订阅——免费午餐的撤桌路径,AI 正在完整复刻。
01DeepSeek 的「峰谷电价」一天被切成两段
这次的核心不是简单涨价,而是一套「时段定价」机制。一天被切成两段:高峰 9:00-12:00、14:00-18:00,其余时间算闲时。高峰执行全价,闲时直接打五折。
高峰 · 全价
9:00-12:00
14:00-18:00
输出价 27 元/百万 tokens
是旧价的 4.5 倍
闲时 · 五折
其余时间
输出价约为 13.5 元/百万 tokens
= 高峰价的一半
「百万 tokens」是 API 计价常用单位,1 百万 tokens 约等于几十万汉字。闲时价格按官方「高峰价 50%」的规则折算。
但整个方案里最刺激的,还不是时段差价。
缓存命中输入价从 0.025 元直接跳到 0.3 元/百万 tokens,一夜之间翻了 12 倍。缓存命中,指重复内容直接走缓存、不再重新计算——它向来是 API 账单里最便宜的部分。现在,连「最便宜」也消失了。
涨幅最高缓存命中输入价格 0.025 → 0.3 元/百万 tokens,上涨 12 倍(1100%)——这是本次计价调整中幅度最大的一项。
开发者的反应很真实:有人连夜把批量任务改到凌晨跑,有人开始逐家对比各家的闲时价格表。
但更多人意识到另一层:连「价格屠夫」DeepSeek 都端不住了。
02一整年的涨价潮没人能独善其身
DeepSeek 不是第一个涨价的。早在今年 5 月,豆包已在 C 端上线付费会员;此后腾讯云、Kimi、智谱、MiniMax 一个接一个跟进。
2026/03
腾讯云:混元 HY2.0 Instruct 输入价上调 463%;次月 AI 算力产品再涨 5%
+463%
2026/05
豆包:C 端三档会员上线,68/200/500 元每月;长文档、批量生成划入付费专享
会员制
2026/06
MiniMax:M3 发布同日,输入价 2.1→4.2 元,输出价 8.4→16.8 元,无提前通知
+100%
2026/07
Kimi:K3 输出价 100 元/百万 tokens(较上代涨 3.5 倍);C 端会员上线 48 小时即暂停新订阅
+3.5×
年内×5
智谱:五次上调 API 定价,一季度涨幅约 83%,调用量反而增长 400%
+83%
近日
DeepSeek:峰谷分级计价上线,缓存命中输入价涨 12 倍,高峰输出价 4.5 倍
12×
看懂了这张表,就明白了行业的真实处境。
C 端会员只是冰山一角。真正决定行业走向的是 B 端 API 价格体系——它直接关系到 AI 应用的开发成本和生态繁荣。当上游全面提价,下游每一款 AI 应用的账单,都会慢慢传导到终端用户面前。
一个诚实的注脚:低价不仅放大了亏损,还引来了大量低价值、高并发的无效请求——爬虫、测试脚本——它们挤占了高价值企业客户的算力。涨价,某种程度上也是一次「清场」。
03为什么必然:AI 的物理成本账
很多人第一反应是「割韭菜」。但算过 AI 的账之后,你会同意:这轮涨价几乎是必然。
互联网产品逻辑
抖音、微信的边际成本趋近于零,流量即金钱,免费可以无限持续。
生成式 AI 逻辑
每一轮对话、每一次文档解析、每一张图片生成,背后都是 GPU 在真烧电、真烧钱。
电费、设备折旧、算力消耗,全是硬成本。
140万亿中国日均 Token 调用量 · 2026 年 3 月,较 2024 年初增长超千倍
2000亿字节 2026 年 AI 基础设施开支预估(元)
3.82亿豆包月活用户 · 断层第一
180万亿豆包日均 Token 调用量(公开报道口径)
不同统计口径与时点导致数据并存,此处仅作数量级参考。日均调用量数据来自公开报道与国家数据局统计。
更棘手的是,低价不仅放大亏损,还招来了大量无效请求。当每一轮调用都在真实地烧钱,低价本身就成了一种不可持续的亏本买卖。
DeepSeek 的「峰谷电价」,本质上是借鉴电力行业的削峰填谷策略。它并非一味想多收钱,而是利用价格杠杆,把白天的拥堵请求「赶」到晚上跑,从而避免为了应对峰值流量而不断扩容 GPU 集群的巨额资本开支。
所以这轮涨价没有赢家通吃,只有算力账单的理性回归。资本市场,已经不愿意为「无底线烧钱」的故事继续买单了。
04从烧钱到收网商业模式的分岔路口
涨价不是目的,商业化才是。这轮涨价潮里,字节的玩法最值得琢磨。
🫘 豆包:长出「交易平台」的骨架C端会员 + 交易抽佣
- 5 月上线三档会员:标准版 68 元/月、加强版 200 元/月、专业版 500 元/月;免费用户仍可访问,但长文档、批量生成、高峰优先算力划归付费。
- 更值得琢磨的是抽佣:豆包推荐订酒店并完成下单后,会抽取相应支付渠道服务费;打车服务也在灰度测试同类模式。
- 梁汝波 8 月 6 日全员会定调:希望豆包成为「主干」业务,像抖音一样长出电商、生活服务这些分支。
字节的打法从未变过——先不计成本圈用户,形成规模优势,再慢慢收网。抖音、TikTok 都是这么起来的。
🧩 字节的「三张牌」C端 + 企业 + 云
- 超级 C 端入口豆包、企业协作底座飞书、云基础设施火山引擎——三者打通的厂商,目前国内不多见。
- 对照:百度的组合是「文心+云」,但企业级产品矩阵不如飞书完备;阿里是「通义+钉钉」,C 端规模与豆包仍有差距。
谁先让「AI 入口 + 企业底座 + 云算力」形成闭环,谁就掌握了下一轮商业化的主动权。
🧭 其他选手的路径三条差异路线
- 智谱:技术快速迭代 + 年内五次调价,走出「量价齐升」曲线——涨价 83%,调用量反而增长 400%。
- Kimi:押注编程等高价值场景,借助 Mooncake 架构把实际使用成本压下来。
- 腾讯云:全线涨价,从模型 API 到底层算力全面提价。
殊途同归。涨价从来不是目的,找到可持续的商业模式才是。
05免费午餐的撤桌史AI 正走上同一条路径
这情形熟悉吗?免费午餐的撤桌,几乎遵循同一条路径:先用免费培养习惯、建立规模,再通过分层收费完成商业闭环。
2002 年
263.net 全面取消免费邮箱服务,国内互联网第一次大规模「免费晚餐」撤桌。
2010 年代
网盘「免费大战」落幕,行业最终走向单次加速收费与会员订阅。
2026 年 5 月
Meta 正式推出 Instagram、Facebook、WhatsApp 付费订阅计划。
2026 年
大模型集体涨价——AI 站上了同一条路径。
回看今年年初,整个 AI 行业还在用真金白银「请全国人民喝奶茶」的方式抢用户。半年过去,同一批玩家已经集体涨价——从撒币到收费,翻脸比翻书还快。
但这情形并不令人意外。
任何时代的红利都有终结。免费浪潮的退去,本质是行业从野蛮生长走向规范发展。当厂商不再靠烧钱抢用户,而是靠真实能力留住用户,竞争才真正开始。
编辑核心判断
免费浪潮的退去,不是 AI 价值的缩水,而是价值计价的开端。当一项服务开始收费,正说明它真的能帮你——简单咨询会继续免费,但能节省时间、创造实际收益的生产力服务,理应付费。行业真正要回答的问题不是「要不要收费」,而是:你的 AI,值不值这个价。
▶下一步:该做什么三类人的行动清单
👨💻
开发者
批量任务挪到闲时波段;优化缓存命中率——那仍是账单里最便宜的 token。
👤
个人用户
日常问答依旧免费;付费的是长文档、批量生成与高峰优先算力,按需订阅即可。
🏢
决策者
把「AI 投入产出比」写进 KPI——按价值选模型,而不是按名气。