Seedance 2.5 发布:30秒原生直出、多模态参考上限50个——字节跳动视频生成模型剑指产业级应用
7月31日,字节跳动 Seedance 2.5 正式发布。单次生成时长从15秒翻倍至30秒原生直出,支持最多50个多模态素材参考,局部编辑精度达1秒以内,并新增白模参考能力。这是Seedance系列从消费级走向产业级的关键一步。
7月31日,字节跳动 Seedance 2.5 正式发布。单次生成时长从15秒翻倍至30秒原生直出,支持最多50个多模态素材参考,局部编辑精度达1秒以内,并新增白模参考能力。这是Seedance系列从消费级走向产业级的关键一步。
Seedance 2.5 的升级集中在四个维度:时长、参考输入、编辑控制、生产集成。每一项都指向一个更明确的目标——让视频生成从"能看"变为"能用"。
具体而言:单次生成从15秒拉到30秒原生直出,支持多轮延长;参考素材涵盖图片(最多30张)、视频(最多10个)、音频(最多10个),总量上限50个;局部编辑支持细节修改与元素增减,时间戳精度控制在1秒以内;新增绿幕和白模参考能力,可通过Maya、Blender插件调用,覆盖十余种语言并同步口型与语速。
注:多模态素材上限为三种类型合并计算,图片单张不超过4K/30MB,视频单个不超过200MB/30秒,音频单个不超过15MB/30秒。
我们通过即梦AI对Seedance 2.5进行了多维度实测,覆盖单人表演、多人交互、专业参考与多模态融合。以下是四个代表性场景的表现。
注:以上测试均通过即梦AI平台完成,提示词为同一组,部分场景因审核拦截需调整措辞后重新提交。测试结果反映的是模型在典型使用场景下的表现,不代表所有场景。
与2.0相比,2.5在多个维度上有了质的飞跃,但并非所有问题都已解决。
但2.5仍留有短板。视频延长虽能保持视觉连续性(人物、画风、光线不变),却在叙事节奏上出现了断裂——延长部分没有顺势推进剧情,更像拼接了一段新内容。这意味着模型能识别前一段视频"长什么样",却还不能完全理解剧情"讲到哪里"。
此外,提示词审核的不稳定性在多个场景中反复出现,精细描述人物状态、镜头语言和场景氛围时,审核拦截会影响创作节奏。对于需要精确控制画面的专业用户来说,这是一个需要解决的体验问题。
注:对比基于公开报道与实测结果,2.0的数据来自2月发布时的用户反馈与媒体评测,2.5的数据来自本次实测。
Seedance 2.5 的升级节奏需要放在字节AI业务加速商业化的背景下理解。2025年下半年以来,字节大幅增加了AI算力采购与研发投入,2026年计划AI资本开支约2000亿元。
Token调用量并不直接等于收入。相比竞争激烈、价格不断下探的通用模型API,视频生成的单价和商业价值更高,也有更大的毛利空间。广告公司、制造企业和影视机构等行业存在持续生产营销素材、产品视频和影视内容的需求,也更愿意为稳定、可控的视频生成能力付费。
Seedance 2.0发布后,短剧和漫剧制作公司已开始采购火山引擎的视频模型服务。内容制作公司用模型生成AI视频,再进入抖音、红果等内容平台分发,流量和收入反过来刺激生产需求。字节因此有机会形成从模型 → 云服务 → 内容平台的商业闭环:
Seedance 2.5 要承担的,正是提高这条链路中的可用率和生产效率,成为火山引擎体系中具有增收潜力的产品。从"能生成"到"能交付",是字节AI从消费级走向企业级的关键一步。
Seedance 2.5 是一个"诚实"的升级——它没有试图用炫技掩盖问题,而是针对2.0暴露的缺陷逐一修补:肤质差了就改善肤质,时长不够就拉长时长,控制力弱就加入白模和局部编辑。
但数据只是故事的一部分。一个诚实的注脚:
多模态理解与叙事连续性仍然是视频生成模型"最后一公里"的硬骨头。Seedance 2.5 在素材容量上迈出了一大步,但模型对素材之间逻辑关系的理解还停留在"视觉相似"而非"语义因果"。视频延长能保持画风一致,却无法延续叙事节奏——这暴露了当前视频生成模型的本质瓶颈:它们擅长模仿"看起来像",但尚未真正理解"故事怎么讲"。
对于字节而言,Seedance 2.5 的意义不只在于技术指标的提升,更在于它让视频生成从"可预览"迈向了"可交付"。当广告公司、影视机构开始为稳定的生成能力付费,这个商业闭环才算真正跑通。
视频生成已进入"工程化"阶段——模型能力的差距在缩小,系统稳定性、可控性与交付效率正在成为新的竞争壁垒。
Seedance 2.5 已通过即梦AI上线,支持30秒原生视频生成、多模态参考与局部编辑。登录即梦AI即可体验。
即梦AI → 体验 Seedance 2.5