AI 战略观察

字节AI:拒绝蒸馏,押注数据与生态闭环,豆包月活3.82亿

字节跳动以“拒绝蒸馏”为战略锚点,放弃短期追赶,通过构建自研数据飞轮与AI生态闭环,赌一个与行业主流不同的多模态超级入口未来。

创始人

张一鸣

不会把蒸馏当作捷径
CEO

梁汝波

接受短期落后,动作不要变形
可蒸馏 拒绝蒸馏
内部政策变化 禁止蒸馏K3等开放权重模型 2025年7月Seed全员会后出台
禁令生效

01 / 战略定调:创始人公开拒绝蒸馏

“字节跳动不会把蒸馏当作提升AI模型能力的捷径,即便Seed的模型能力暂时落后于国内主要的竞争对手。”

—— 张一鸣 · 字节跳动创始人

“字节大语言模型会坚定自研,做好基本功,接受短期落后,坚持优化长期,最重要的是动作不要变形。”

—— 梁汝波 · 字节跳动CEO

蒸馏技术虽可快速提升模型能力,但字节认为沿此路径只能逼近对手,无法实现超越,且会损害多模态原生的能力根基。

内部政策变化 禁止蒸馏K3等开放权重模型 Seed内部曾讨论是否蒸馏美国头部模型,被管理层否决;Kimi K3出现后内部偏向蒸馏的声音增多,张一鸣表态后出台新规。

02 / 数据驱动:组建超千人数据部门,预算超千万美元

字节拒绝蒸馏后,选择以数据为核心竞争力,成立新一级部门“AI数据与安全”,整合超千人团队,提供跨模态数据服务。

数据预算 超千万美元 2026年字节数据预算已超千万美元级别,且可随时追加预算。
数据优势 全球DAU级行为数据 全球用户每天产生海量行为数据,真实、带有上下文的图文、视频、直播数据成为大模型稀缺训练材料,源自字节十年数据飞轮积累。

行业数据稀缺趋势

语言模型训练将在未来五年耗尽人类公开文本数据,高质量语言数据可能提前至2026年枯竭。

  • Anthropic — 2025年为RL数据拨出超10亿美元预算
  • OpenAI — 2025年全年数据开销约10亿美元,预计2030年达80亿美元

03 / 商业化闭环:豆包收费、飞书合并、全域交易链路打通

豆包月活 3.82亿 2026年6月第三方监测数据 · 同比增速172.1%,AI原生APP月活第一。
商业化收费 三档会员+抽佣 68/200/500元每月;自8月10日起对生活服务订单抽佣,酒店综合费率约12%,部分生活服务约18%。
Seedance年化收入 20亿美元 Seedance 2.0视频生成模型年化收入达20亿美元(约143亿元),据行业媒体披露。

飞书产品团队全盘并入豆包,豆包打通生活与办公两大场景,成为统一AI入口,并带动交易链路独立计价。

04 / 生态飞轮:底座模型 + C端/B端三层协同

字节AI生态分为三层:C端豆包前端蓄水,B端服务中端开闸,Seed与火山引擎底层筑基,三层打通形成从流量到变现的闭环。

C端 豆包前端蓄水 — 流量入口与用户心智
B端 服务中端开闸 — 企业级场景与商业化变现
底层 Seed与火山引擎筑基 — 模型研发与基础设施
“字节不需要用别人的输出来快速补课AI,它更需要的是用时间去打磨场景、积累数据,像以往孵化APP那样,将大模型当成一个能长出商业模式的实体。”

—— 文章作者

字节路径

自研数据飞轮 + 多模态原生 + 场景化商业闭环

行业主流路径

蒸馏追赶 + 参数竞赛 + API或模型售卖

编辑判断

本文深入分析了字节AI在2025年中的战略转向——从被动追赶转向主动构筑数据壁垒与生态闭环,核心论据充分(张一鸣表态、数据部门成立、商业化数据),但缺乏对竞争对手策略的横向对比(如DeepSeek、Kimi的蒸馏策略效果),且对“数据飞轮能否持续支撑模型迭代”的潜在风险未展开讨论。

最终结论

字节AI正以“拒绝蒸馏”为旗帜,用自身最擅长的数据飞轮和场景化商业能力,构建一个更慢但更具壁垒的AGI路径。短期可能落后于对手,但若多模态与数据闭环形成正向循环,有望在超级入口竞争中占据主导地位。风险在于自研模型能否在长期保持竞争力,以及数据飞轮是否会被监管或技术变革打破。