字节AI:拒绝蒸馏,押注数据与生态闭环,豆包月活3.82亿
创始人
张一鸣
不会把蒸馏当作捷径
CEO
梁汝波
接受短期落后,动作不要变形
可蒸馏
拒绝蒸馏
■
内部政策变化
禁止蒸馏K3等开放权重模型
2025年7月Seed全员会后出台
禁令生效
01 / 战略定调:创始人公开拒绝蒸馏
“字节跳动不会把蒸馏当作提升AI模型能力的捷径,即便Seed的模型能力暂时落后于国内主要的竞争对手。”
—— 张一鸣 · 字节跳动创始人
“字节大语言模型会坚定自研,做好基本功,接受短期落后,坚持优化长期,最重要的是动作不要变形。”
—— 梁汝波 · 字节跳动CEO
蒸馏技术虽可快速提升模型能力,但字节认为沿此路径只能逼近对手,无法实现超越,且会损害多模态原生的能力根基。
内部政策变化
禁止蒸馏K3等开放权重模型
Seed内部曾讨论是否蒸馏美国头部模型,被管理层否决;Kimi K3出现后内部偏向蒸馏的声音增多,张一鸣表态后出台新规。
02 / 数据驱动:组建超千人数据部门,预算超千万美元
字节拒绝蒸馏后,选择以数据为核心竞争力,成立新一级部门“AI数据与安全”,整合超千人团队,提供跨模态数据服务。
数据预算
超千万美元
2026年字节数据预算已超千万美元级别,且可随时追加预算。
数据优势
全球DAU级行为数据
全球用户每天产生海量行为数据,真实、带有上下文的图文、视频、直播数据成为大模型稀缺训练材料,源自字节十年数据飞轮积累。
行业数据稀缺趋势
语言模型训练将在未来五年耗尽人类公开文本数据,高质量语言数据可能提前至2026年枯竭。
- Anthropic — 2025年为RL数据拨出超10亿美元预算
- OpenAI — 2025年全年数据开销约10亿美元,预计2030年达80亿美元
03 / 商业化闭环:豆包收费、飞书合并、全域交易链路打通
豆包月活
3.82亿
2026年6月第三方监测数据 · 同比增速172.1%,AI原生APP月活第一。
商业化收费
三档会员+抽佣
68/200/500元每月;自8月10日起对生活服务订单抽佣,酒店综合费率约12%,部分生活服务约18%。
Seedance年化收入
20亿美元
Seedance 2.0视频生成模型年化收入达20亿美元(约143亿元),据行业媒体披露。
飞书产品团队全盘并入豆包,豆包打通生活与办公两大场景,成为统一AI入口,并带动交易链路独立计价。
04 / 生态飞轮:底座模型 + C端/B端三层协同
字节AI生态分为三层:C端豆包前端蓄水,B端服务中端开闸,Seed与火山引擎底层筑基,三层打通形成从流量到变现的闭环。
C端
豆包前端蓄水 — 流量入口与用户心智
B端
服务中端开闸 — 企业级场景与商业化变现
底层
Seed与火山引擎筑基 — 模型研发与基础设施
字节路径
自研数据飞轮 + 多模态原生 + 场景化商业闭环
行业主流路径
蒸馏追赶 + 参数竞赛 + API或模型售卖
编辑判断
本文深入分析了字节AI在2025年中的战略转向——从被动追赶转向主动构筑数据壁垒与生态闭环,核心论据充分(张一鸣表态、数据部门成立、商业化数据),但缺乏对竞争对手策略的横向对比(如DeepSeek、Kimi的蒸馏策略效果),且对“数据飞轮能否持续支撑模型迭代”的潜在风险未展开讨论。
最终结论
字节AI正以“拒绝蒸馏”为旗帜,用自身最擅长的数据飞轮和场景化商业能力,构建一个更慢但更具壁垒的AGI路径。短期可能落后于对手,但若多模态与数据闭环形成正向循环,有望在超级入口竞争中占据主导地位。风险在于自研模型能否在长期保持竞争力,以及数据飞轮是否会被监管或技术变革打破。