🎬 视频生成 · 产品实测

免费视频模型实测:一句话故事,自动拆成10集短剧

8 月 26 日,Agnes Video 2.5 系列上线 Pavo,其中 Flash 版完全免费。实测发现:它不仅把单次生成成本打到零,还通过短剧 Harness 把一句话剧情自动拆成10 集分镜,让"拍短剧"第一次变得像"填表格"一样结构化。

来源:公开报道 2026-08-27 全文约 4 分钟读完
#Pavo #Agnes Video 2.5 #AI短剧 #视频生成
¥ 0 Flash 版完全免费 · 单条 4-12 秒
100 秒/天 Agnes 2.5 每日赠送积分,可免费生成
10 一句话故事 → 自动拆出 10 集剧情

⚡ 30 秒速览

  • 免费到什么程度:Agnes Video 2.5 Flash 完全免费,720p 输出;标准版每天送 200 积分,可免费生成约 100 秒。
  • 实测表现:10 秒特写戏,面部、手部、身体动作同步,情绪连贯——免费模型没有砍掉表演能力。
  • 工作流革命:输入一句话,自动拆出 10 集剧情、人物/场景/道具资产、单集分镜(含景别与机位)。
  • 画布模式:节点分支 + 3D 导演台,多人同框、特殊机位不用靠抽卡,提前把站位和镜头摆出来。
  • 成本双杀:模型免费解决"敢不敢多试",Harness 解决"要不要重做"——两部分叠加,才是短剧成本真正的下降。

01免费模型,不等于"低配" 榜单与参数

免费的视频模型,会和"低配"划等号吗?这次我们直接上强度,先测一类最考验人物表现的镜头:特写戏

Agnes Video 2.5 系列目前分为两个型号。Flash 版完全免费,标准版每日赠送积分。

Agnes Video 2.0(前代)

主流视频模型竞争区间之外,人物动态与镜头一致性有明显短板。

Agnes Video 2.5(当前)

完成一次明显跃升,已进入主流商业视频模型的竞争区间。

720pFlash 输出规格
4-12s单条时长范围
5 张图片参考输入
1K/2K标准版支持分辨率

参数来自公开产品页与实测环境。Flash 免费版与标准版共享同一代模型能力,区别主要在分辨率与参考输入数量。

从榜单成绩看,Agnes 视频模型从 2.0 到 2.5 完成了一次明显跃升——但榜单只是起点。

真正要看的,是把几十个镜头串起来以后,它还能不能扛住完整短剧制作。

02特写戏实测 10 秒提示词,情绪连贯

我们给 Flash 版输入了一段 10 秒的复杂特写戏提示词,要求从"枪口指向镜头"到"眼眶湿润、枪口下沉",全程模拟呼吸律动。

🎬 特写戏:持枪者的情绪崩塌动作与表情同步

  • 没有逐字执行:模型没有机械复刻每句提示词,但关键动作节点——眼神一颤、眉心一蹙、喉结滚动、枪口下沉——全部到位。
  • 各部位协同:面部、手部、身体动作没有"各演各的",情绪变化连贯,有一定感染力。
  • 短剧关键能力:真正占据短剧大量镜头的就是人物表演。如果每个细微动作都要反复抽卡,单镜头再便宜也会被返工拉高成本。
实测结论:免费模型没有把人物动态和表演能力一起砍掉

但真正决定短剧成本的,不是单镜头质量,而是几十个镜头的串联效率。于是我们给 Pavo 扔了一个非常粗糙的故事:

蜘蛛侠大战十个神秘客。只有一句话,甚至称不上剧情。

03成本账:模型免费 + 流程不返工

AI 短剧里,很大一部分钱烧在"再来一条"上。几十上百个镜头,前期试风格、设计人物、排练分镜;正式生成后还会遇到角色变脸、动作失败、构图跑偏、镜头接不上。

单次生成成本

好用的模型大多不便宜,一条片子几十个镜头,抽卡和返工的钱越积越多。

Pavo 的组合拳

Flash 免费压单次成本;Harness 把角色、场景、分镜组织起来,减少重复设定和无效返工。

¥ 0Flash 单条生成
100s标准版每日免费额度
10 集一句话自动拆解
3 层资产→分镜→生成

免费额度按 1 秒消耗 2 积分、每日赠送 200 积分折算。实际短剧场景中,返工减少带来的时间成本下降,往往比生成费更可观。

模型免费,解决的是敢不敢多试几次;Harness 解决的是同一件事要不要反复重做

这两部分加在一起,才是更实际的成本下降。

04一句话 → 10 集短剧 Harness 自动拆解

我们输入"蜘蛛侠大战十个神秘客",选择生成 10 集,然后交给 AI Script Creator。它没有急着吐成片,而是先把中间环节一层层搭好:

一句话故事 10 集剧情 人物/场景/道具资产 单集分镜 图片+视频生成

场景被拆出了纽约街头、废弃仓库、医院走廊、矩阵基地等十多个地点;道具细到蜘蛛发射器、量子装置、全息投影地图。人物更细——同一个角色拆出基础形象、便服、病号服、破损战衣,并指定分别在哪几集使用。

纽约街头 废弃仓库 医院走廊 临时实验室 矩阵基地 蜘蛛发射器 量子装置 全息投影地图 基础形象 破损战衣 病号服

以上为实测中 Harness 自动整理的部分场景、道具与角色变体。进入连续剧情后,这些资产可被后续剧集持续调用,避免"上一集的东西下一集对不上"。

进入 Episode Videos 后,第一集"神秘客的警告"继续拆出"屋顶落地""平静的低语""警觉与飞跃"等镜头,每个镜头已写清景别、机位与画面内容。

一开始只有一句话的故事,到这里已经被逐层整理成:故事主线 → 10 集剧情 → 资产 → 单集场景 → 具体分镜 → 图片与视频生成

这就是 Pavo 短剧 Harness 的价值:它没有追求"一键给我吐出一部成片"这种看起来很魔法的体验,而是把短剧本来就需要处理的中间环节提前搭好。

05关键镜头不靠抽 画布 + 3D 导演台

自动化流程能把一部短剧快速搭起来,但拍到关键镜头时,创作者往往又遇到另一个问题:想要的画面越具体,纯靠提示词碰运气就越难

于是我们换了一种玩法——进入 Pavo 的无限画布,自己搭框架。故事只有四句话:暴雨夜,红衣女子带玉佩逃进废弃客栈;黑衣男人追进来;短暂交手后,男人摘下面具——竟是她失踪多年的哥哥。

🌿

节点分支:局部返工不重来

故事从 Text Node 向外长出多个分支。第三段不满意,直接改第三个节点;想试新走向,从同一个上游节点再拉一个分支。旧版本不消失,新尝试不用重新复制整套上下文。

🎭

角色设定:先做视觉档案

红衣女主拆出正面、侧面、背面、45 度视角,服装、发型、腰封、长剑全部固定;黑衣男主同样生成完整设定。先给演员做一份视觉档案,再让他们"出演"。

🎥

3D 导演台:显式控制机位

两人面对面、一前一后;低机位仰拍、绕到侧后方——这些空间信息塞进 Prompt 未必被同时执行。在三维空间里把人物站位、身体比例、摄影机位置先摆出来,复杂构图就多了一层显式控制。

这样一来,Pavo 里形成了两套不同的创作节奏:快速产出用 Harness 铺开剧本、资产和分镜;关键镜头切回 Canvas,用角色资产、节点分支和 3D 导演台一点点细调。

编辑核心判断

当模型能力和算力成本变成基础条件,创作门槛重新落到剧本、人物、镜头、节奏和审美上。

免费模型把"敢不敢试"的钱省了,Harness 把"要不要重做"的时间省了——但最终决定一部短剧能不能看的,仍然是创作者对故事和情绪的理解。工具的门槛在降低,审美的门槛反而更显眼。

现在就能用

全新的 Agnes Image 2.5 图片模型也已同步上线 Pavo,补齐角色、场景、关键帧到视频生成的完整链路。登录官网即可体验。

Pavo 官网 → 免费开始创作