虎牙发布VAM 1.0实时多模态数字人模型,AI正在重构内容供给的成本结构
8月11日,虎牙公布2026年Q2财报,总收入17.4亿元,连续六季同比增长。但比财务数据更值得读的,是背后那项正在改变直播内容生产逻辑的技术——VAM 1.0实时多模态数字人模型。
8月11日,虎牙公布2026年Q2财报,总收入17.4亿元,连续六季同比增长。但比财务数据更值得读的,是背后那项正在改变直播内容生产逻辑的技术——VAM 1.0实时多模态数字人模型。
虎牙这份Q2财报,表面上是收入的稳步增长:总收入17.4亿元,同比+11.0%,连续六个季度保持正增长。其中游戏相关服务、广告及其他收入同比+54.1%至6.4亿元,占总收入比例已提升至36.7%。
但真正的新闻,不在财务数字里。
7月,虎牙发布了自研的实时多模态数字人模型VAM 1.0。这个模型能快速生成兼具自然语音、歌唱与肢体表达能力的AI数字人,并实现实时互动。CEO黄俊洪在财报电话会上的定调很明确:游戏发行将继续作为重要战略方向,而AI能力是支撑这一战略的关键底座。
注:四项数据均来自同一份财报,单位已统一为人民币。游戏相关服务收入占比的提升,反映虎牙收入结构正从直播依赖走向多元化。
VAM 1.0的关键词是实时与多模态。它不是传统意义上的"虚拟形象+语音合成",而是将自然语音、歌唱、肢体表达三种能力整合进一个实时互动的数字人模型。
这意味着什么?对比一下传统内容生产方式就清楚了:
受限于主播数量、时间与精力。一场直播需要真人全程在场,内容供给存在天然天花板。
自然语音+歌唱+肢体表达,实时互动。突破真人主播的数量和时间限制,内容供给可规模化扩张。
VAM 1.0的想象空间,不在于"替代主播",而在于补足供给——那些真人主播覆盖不到的时段、品类和场景,AI数字人可以填上。
直播行业长期面临一个结构性矛盾:内容供给的边际成本高企。每增加一小时直播,就需要一小时的真人时间。VAM 1.0正在打破这个等式。
注:链路示意VAM 1.0在内容生产中的位置——模型替代的是"生成"环节,而非整个内容生态。真人主播与AI数字人将共存互补。
除了VAM 1.0,虎牙还在围绕热门游戏品类上线AI工具,直接反哺平台内容生态。
这不是规划,是已经上线的功能。
与此同时,VAM 1.0的落地场景也在扩展。7月以来,《鹅鸭杀》手游围绕对局语音环境加强治理,并联动经典IP《西游记》推出聚会场景玩法——这类内容运营背后,AI能力正在成为支撑体验升级的底层设施。
AI叙事最终要回到财务验证。虎牙Q2的数据给出了阶段性答案:
注:柱形宽度为相对值,用于直观对比增速差异,不代表绝对规模。非零起点。
更强的信心信号来自资本动作:董事会批准将"2026年股票回购计划"授权额度由5000万美元提升至1亿美元,翻倍。截至6月30日,公司已累计回购价值760万美元的股票。
CFO雷鹏的表述直接点明了逻辑:"随着游戏相关服务、广告及其他收入持续增长,公司经营层面的财务表现稳步改善。"AI能力驱动的内容供给扩张,正在转化为可量化的收入结构优化。
AI不再是直播平台的辅助工具,而是正在重构内容供给的根本成本结构。当数字人能以接近零边际成本批量生产内容,直播平台的竞争逻辑将从"争夺主播"转向"争夺AI能力"。
打开虎牙直播 App,在热门游戏赛事与直播中,即可感受AI数字人与AI游戏工具带来的体验升级。
虎牙直播 App → 体验AI内容