💸 模型 · 商业观察

实测 8 毛 8 修好生产 Bug:DeepSeek 的"低价斩杀线",被一纸涨价预告戳破

8 月 6 日,DeepSeek 在用户后台突然预告:全部 API 接口将整体提价,涨幅较大。距离 V4 Flash 正式版上线仅一周——这款刚在 OpenRouter 创下单周 7.1 万亿 Token 消耗纪录的模型,踩下了刹车。

综合公开信息整理 2026-08-06 全文约 4 分钟读完
#DeepSeek #V4 Flash #API 定价 #算力基建
0.88 元 修好一个生产 Bug · 单次实测
0.03 美元 单任务平均成本,比旗舰低 105 倍
7.1 万亿 Token 单周消耗量 · OpenRouter

⚡ 30 秒速览

  • 事件:7 月 31 日 V4 Flash 正式版公测,284B 总参 / 13B 激活 MoE,仅重做后训练,9 项 Agent 基准全面超越自家 V4-Pro 预览版。
  • 实测:21.7 万 Token、缓存命中 99.8%,总成本 0.88 元定位并修复生产 Bug,信源匹配量从 1966 恢复至 11020。
  • 价格锚点:输出 0.28 美元/百万 token,单任务成本 0.03 美元,比 Claude Fable 5 便宜 105 倍。
  • 短板:不支持多模态图像输入,多步骤长流程任务规划吃力,单点定位是绝对主场。
  • 反转:8 月 6 日预告 API 整体提价,OpenRouter 单周 7.1 万亿 Token 的"报复性调用"逼停低价。
  • 资本:重启 500 亿元第二轮融资,投前估值 5000 亿元,超六成投向算力基建与国产芯片适配。

01一次"唯一改动"引发的行业震荡 V4 Flash 正式版

7 月 31 日,DeepSeek 在 API 文档更新了一条日志:DeepSeek-V4-Flash 正式版上线公测。架构与参数规模和 4 月 24 日开源的预览版完全一致——284B 总参数、13B 激活参数的 MoE 架构,唯一重做的东西,是后训练。

然而正是这唯一的改动,让整个行业惊掉了下巴。

预览版 · 4 月 24 日开源

284B / 13B MoE 架构,参数规模与正式版完全一致,后训练为旧版本。

正式版 · 7 月 31 日公测

唯一重做后训练,9 项 Agent 基准测试全面超过自家旗舰 V4-Pro 预览版,指令遵循能力呈跨代际提升。

更直接的动作是:首次原生支持 Responses API 格式,开发者可以直接在 ChatGPT 桌面端或 VS Code 插件里,将底层引擎无缝切换为 DeepSeek——剑指 OpenAI 的 Codex。

注:以上对比基于官方公布的 9 项 Agent 基准,覆盖指令遵循、工具调用与多步任务完成等维度;"跨代际提升"为官方口径。

02实测:修复生产 Bug,仅需 8 毛 8

跑分之外,真正的杀伤力在真实场景。测试机会来自一次偶然——一套自建舆情管理系统出了 bug:信源匹配数量断崖式下跌,前一天还能匹配出 1 万多条数据,当天只剩不到 2000 条。

🐛 生产环境 Bug 修复 一次修复成功

  • 3 分钟定位:遍历"屎山代码"后,锁定匹配历史骤减的根源——每次遍历信源后的归档写出环节存在错误,导致历史库条目大幅下降。
  • 一次修复:匹配数量从 1966 条恢复至 11020 条,全程不到 3 分钟。
  • 计划外收获:顺手揪出信息条目重复的暗病,附赠去重方案。
  • 消耗:整个项目约 21.7 万 Token,缓存命中率高达 99.8%,总成本仅 0.88 元(约 0.13 美元)。
  • 更精确地说:仅算 Bug 定位与修复,成本为 0.27 元(约 0.04 美元)。
诚实的注脚:单点定位、单次修复是它的绝对主场。284B 总参 / 13B 激活的体量,决定了它在复杂、长流程的任务规划中依然吃力——一旦拉长到多步骤、多分支的完整工程,表现会不可避免地下降。

03"斩杀线"到底在哪?跑分不是最强,但最便宜

发布后,"干翻 Claude"的说法铺天盖地。但先看一组诚实的跑分——据第三方评测机构的综合智能指数:

Kimi K3月之暗面
57
GLM-5.2智谱
51
V4 Flash 正式版DeepSeek
50

注:智能指数得分,V4 Flash 排第三,落后于两款国产模型。但真正的"斩杀线"不在跑分,而在价格。

输出定价(美元 / 百万 token):V4 Flash 为 0.28 美元;GLM-5.2 为 4.29 美元,是它的 15 倍;Anthropic 旗舰 Claude Fable 5 为 50 美元,是它的 178 倍

Claude Fable 5Anthropic
50
GLM-5.2智谱
4.29
V4 FlashDeepSeek
0.28

注:柱形自 0 起线性缩放,V4 Flash 的条极短(0.6%),接近不可见——这正是"斩杀线"的图景。分差以标注数值为准。

按第三方评测口径估算,完成一项任务的平均成本:V4 Flash 约 0.03 美元,Kimi K3 约 0.86 美元,Claude Fable 5 约 3.15 美元。最贵与最便宜之间,差了 105 倍

"性能比它强的,价格贵出一两个数量级;价格向它看齐的,性能又存在代差。"
——这就是"斩杀线"的真正含义。

04当"报复性调用"撞上算力账单

极低的价格引发全网开发者的疯狂接入。在 OpenRouter 榜单上,V4 Flash 创下单周 7.1 万亿 Token 的消耗量,高峰期的并发请求直接让服务器集群不堪重负。

在自建智算中心尚未完全交付的当下,通过价格杠杆筛选高价值客户、抑制低效高频消耗,成了防止服务器被挤爆的唯一自救手段。

梁文锋曾这样算过账:

"采购一批服务器,大约 10 个月通过 API 收入收回设备成本,在 DeepSeek 内部,这已经算合理利润。"——此前低价不是补贴烧出的战术,而是算法优化带来的结构性成本优势。

但算法的精妙可以压缩单位成本,却无法平抑硬件天花板与现金流压力。于是有了这组数字:

510 亿首轮融资 · 中国大模型史上最大
500 亿第二轮融资 · 已重启
5000 亿投前估值
60%融资投向算力基建与国产芯片

注:两轮合计超千亿元,超六成用于自建智算中心与国产芯片适配;另有一条一年前秘密启动的自研推理芯片产线,以及核心人才团队的扩充。

同一赛道,两条截然不同的路线正在对撞:

DeepSeek · 降价押注"够用就好"

极致 API 定价,克制的产品形态,换取最大调用量。但 8 月 6 日的涨价预告,戳破了低价狂欢的滤镜。

月之暗面 · 涨价押注"更聪明"

Kimi K3 发布后,API 定价比上代涨 3-4 倍,输出达 100 元/百万 token。以 500 亿美元估值开启 Pre-IPO 轮,年内递表。

市场也已闻风而动:V4 Flash 上线前一天,OpenAI 宣布 GPT-5.6 入门款 Luna 降价 80%;8 月 1 日,智谱重新开放一度需要抢购的 GLM Coding Plan 订阅。虽然很难把所有降价都归因于 DeepSeek,但整个行业的价格锚点,正在被重塑。

编辑核心判断

"8 毛 8 修 Bug"的故事固然动听,但涨价预告证明:即便是最擅长成本控制的团队,也无法用算法无限平抑算力的物理成本。当价格战先锋也踩下刹车,行业将从"谁更便宜",转向"谁的商业模式更可持续"。

给开发者的提醒

调价生效前,建议合理规划调用量与充值金额。具体细则与生效时间,以官方正式公告为准。

DeepSeek 开发者后台 → 查看调价细则