💰 商业 · 定价博弈

83天,从"永久降价"到最高12倍涨价——DeepSeek开源Harness背后的商业逻辑

8月17日零时,DeepSeek新版峰谷价格体系正式生效,平均涨幅约3.5倍,最高12倍。而就在83天前,它刚高调宣布V4-Pro预览版"永久降价"75%。同一晚,DeepSeek将Agent运行时框架Harness以MIT协议全面开源——左手派发免费框架,右手抬高算力门槛。

综合公开信息整理 2026-08-17 全文约 4 分钟读完
#DeepSeek #API涨价 #Harness开源 #Agent时代 #大模型定价
12× 最高涨幅 · 缓存命中输入价格
83 从"永久降价"到全面涨价
9.6 Harness 开源 24h GitHub Star

⚡ 30 秒速览

  • 涨价幅度:V4 Pro 缓存命中输入从0.025元涨至0.3元(12倍),输出从6元涨至27元(350%);V4 Flash输出同步涨350%至9元。闲时半价,但成本仍远超此前底价。
  • 时间线:5月22日宣布V4-Pro永久降价75% → 8月13日发布涨价公告+开源Harness → 8月17日新价格生效。83天,从"地板价"到"天花板价"。
  • 涨价原因:算力产能枯竭——V4-Flash单周调用量突破8.83万亿Token,环比暴增570%,全球第一。Agent时代单次任务消耗50万甚至100万Token已成常态。
  • 开源组合拳:Harness框架对标OpenAI Codex与Anthropic Claude Code,MIT协议开源,24小时狂揽9.6万+Star。但同一天API大幅涨价,中小开发者被两面夹击。
  • 行业信号:DeepSeek不是孤例——智谱AI年内三次提价、Kimi K3涨超3.5倍、阿里云与百度智能云涨价5%-34%。大模型价格战正式终结。

01价格底线崩塌 83天,从"永久"到"12倍"

5月22日,DeepSeek高调宣布V4-Pro预览版限时折扣转为"永久价格",降幅高达75%。全行业为之震动——这张价格底牌,被视为大模型"白菜价"时代的终极宣言。

但83天后,一切被改写。

8月17日生效的新版峰谷价格体系,彻底重置了游戏规则。在每天业务高峰时段(9:00-12:00、14:00-18:00),V4 Pro的调用成本全面飙升:

0.3 ↑12× 缓存命中输入(元/百万Token) 原价 0.025
9 ↑200% 缓存未命中输入(元/百万Token) 原价 3
27 ↑350% V4 Pro 输出(元/百万Token) 原价 6
9 ↑350% V4 Flash 输出(元/百万Token) 原价 2

注:价格为高峰时段调用价。闲时半价,但整体成本仍远超此前"永久价"水平。腾讯云CloudBase已同步调整,价格完全跟随。

价格权力的传导链条展现出极强的同步性。腾讯云CloudBase几乎在同一时间官宣完全跟随官方定价,分毫不差。阿里云百炼、硅基流动等托管方也必然面临成本重算。"永久"二字在此刻充满了一种反常识的戏剧性反讽。

5月22日宣布V4-Pro预览版永久降价75%,全行业跟进"地板价"
8月13日发布涨价公告,同步开源Harness框架(MIT协议)
8月17日新峰谷价格体系正式生效,最高12倍涨幅

注:时间线跨度83天。从"永久降价"到"全面涨价",DeepSeek完成了定价策略的180度转弯。

02算力,成了最硬的约束

DeepSeek官方将涨价原因归结为"更合理地分配资源、提升服务稳定性"。但撕开这层表象,真正扼住咽喉的,是算力产能面对指数级需求时的断崖式枯竭

一组数据揭示了消耗的恐怖速度:

🔥 V4-Flash 单周调用量8月3日-8月9日
8.83万亿
环比增幅较前一周
+570%
OpenCode 单日处理量8月1日
8万亿
其中免费额度消耗占比 62.5%
5万亿

注:V4-Flash单周调用量位居全球第一。柱形为相对比例示意,具体数值以标注为准。免费额度消耗占比高达62.5%,说明大量开发者正在"薅羊毛"。

这种物理极限的背后,是Agent时代的结构性反噬。在单纯的对话交互时代,单次任务上下文往往不足2000 Token;但在Agent编排与多步推理工作流爆发的当下,单次任务消耗50万甚至100万Token已经成为常态。服务频繁出现"繁忙"与"超时"——涨价,是硬件物理极限的必然反扑。

创始人梁文锋在流出的投资人闭门交流中曾坦露过其定价哲学:以购买服务器"10个月收回成本"作为倒推基准,只赚取约6倍的合理利润。在极低的价格区间内,开发者对价格敏感度极低——此时将价格翻倍,Token消耗总量并不会数量级衰减,而总营收却能实现近乎翻倍的飙升。有专业人士测算,调价后的V4 Pro真实毛利率可能回升至72%到81%之间。

涨价,不是为了覆盖亏损——而是为了匹配未来庞大的资本开支。

03开源外衣与昂贵词元 Harness的AB面

在发布涨价公告的同一晚,DeepSeek打出了一套极具迷惑性的组合拳:将Agent运行时框架Harness以MIT协议全面开源。这款被定位为"一切皆插件"的执行层框架,直接对标OpenAI的Codex与Anthropic的Claude Code,支持多Agent编排、上下文管理与沙箱调度。

短短24小时,GitHub狂揽9.6万+ Star。

与此同时,V4-Pro的权重也同步MIT开源,进一步降低了私有化部署的门槛。但问题的核心在于:

🔓 开源框架(Harness)

免费、开放、MIT协议,吸引开发者构建生态,锁定心智与基础设施话语权。

💰 API涨价(最高12倍)

同一天生效,大幅抬高调用门槛,让接入Harness的开发者面临更高的算力成本。

首当其冲的,恰恰是那些通过API将模型深度接入企业级产品、构建复杂业务流的中小开发者——而这群人,正是Harness最迫切渴望吸引的核心受众。一边用免费的顶级框架招徕开发者,另一边却亲手推高了开发者的调用门槛。

📦 Harness 开源:战略意图拆解生态锁定

  • 定位:对标OpenAI Codex + Anthropic Claude Code,做"Agent的操作系统"
  • 策略:MIT协议开源,降低采用门槛,抢占开发者心智与基础设施话语权
  • 矛盾:框架免费但Token昂贵——开发者的应用越依赖Harness,面临的API成本越高
  • 结果:可能将部分轻量级创新者推向价格更低廉的第三方托管平台
编辑视角:开源框架与API涨价逻辑并行不悖——前者占生态,后者赚利润。但从开发者体感来看,"大门敞开,但电费暴涨"的落差是真实存在的。

从商业自洽的角度来看,开源框架与权重是为了抢占开发者的心智与基础设施话语权,而API涨价则是为了在云端服务上赚取利润,两者逻辑并行不悖。但从开发者的体感来看,"大门敞开,但电费暴涨"的落差是真实存在的。那个"便宜到完全没有对手"的价格战,已经彻底终结。

04全行业定价中枢上移 DeepSeek不是唯一一个

DeepSeek的涨价并非孤例,它实质上引爆了全行业定价中枢上移的强烈外溢效应。进入2026年以来,涨价潮已全面铺开:

智谱AI 年内三次提价,一季度提价约83%,调用量仍逆势增长400% 月之暗面 Kimi K3 输出价格拔高至百元级别,较前代涨超3.5倍 阿里云 算力产品价格上调 5%-34% 百度智能云 算力产品价格同步上调 5%-34% OpenAI Luna降价80%引流,Sol Fast模式定价翻倍,分层洗牌

长期以来,DeepSeek扮演着国内大模型市场的"绝对价格锚"。如今,这个锚点的松动,实质上为整个行业释放了压抑已久的定价空间。全行业走向分层定价、按价值收费的格局已初步确立。

一组来自OpenRouter的数据值得深思:

🌏 中国模型 Token 处理份额全球占比
超越美国
开放权重模型 Token 处理量占全平台
29%
开放权重模型 收入占比占全平台
<4%

注:数据截至6月初。中国模型在全球AI基础设施中的Token处理份额已超越美国,但开放权重模型处理了29%的Token,却仅获得不到4%的收入。海量使用量并未等比例转化为实际收入。

中国模型在国际市场上长期扮演着"廉价"的角色。海量的使用量并未等比例转化为回流原厂的实际收入。从这个意义上说,DeepSeek的本轮涨价,是中国模型试图将"全球技术影响力"翻译成真实"商业账本"的第一次实质性冲锋。

编辑核心判断

DeepSeek用83天证明:"永久降价"在算力物理极限面前不值一提。Agent时代的需求暴击,让"便宜"不再是护城河——"稳定地贵"比"便宜到宕机"更有商业价值。价格战的终点,不是谁更便宜,而是谁更值得嵌入企业的工作流。

关注 DeepSeek 开发者平台

Harness 框架已开源,新价格体系已生效。这场"开源拉新+涨价收割"的组合拳将如何演变,值得每一位AI从业者持续关注。

platform.deepseek.com → 查看最新定价

Harness 开源仓库:github.com/deepseek-ai/harness