🎬 视频生成 · 产品更新

Google Vids 推出 Gemini Omni 与个人数字分身,一句话生成视频、一张自拍替你出镜

7 月 16 日,Google Vids 上线两项更新:基于 Gemini Omni 的文生视频与对话式编辑能力,以及上传自拍+语音样本即可生成的 个人数字分身。用户用自然语言描述画面、逐步修改片段,或让数字人替自己出镜播报,全程无需架设摄像机。

来源:官方发布 2026-07-16 全文约 3 分钟读完
#Google Vids #Gemini Omni #数字分身 #SynthID

⚡ 30 秒速览

  • 核心更新:Gemini Omni 支持文本提示词 + 图像参考生成视频;对话式逐步编辑,改背景、调灯光只需描述。
  • 数字分身:上传一张自拍和一段短语音,即可生成外貌与声音都像本人的数字人,输入文字即可让分身播报。
  • 透明度机制:每段 AI 生成片段嵌入不可见 SynthID 水印,可验证是否由 AI 生成。
  • 谁能用:面向 Google AI Pro / Ultra 订阅用户及 Google Workspace 商业客户;数字分身限部分地区、18 岁以上用户。
  • 前情铺垫:今年 2 月 Google 已将 Veo 3.1 视频生成模型接入 Vids,此次 Omni 是在生成基础上的编辑与个性化升级。

01两项更新分别是什么

Gemini Omni · 生成与编辑

用自然语言文本提示词生成视频,可叠加图片参考(照片或草稿)提供细节。生成后支持逐步对话式编辑——描述要改什么,Vids 即执行背景替换、灯光修正、特效添加,无需从头重生成。

个人数字分身 · 替你出镜

上传一张自拍 + 一段短语音,生成外貌与声音都接近本人的数字分身。输入文字,分身即以你的形象和声音播报内容,无需架设摄像机或亲自录制

注:Omni 既可编辑 AI 生成片段,也可处理用户手机拍摄的原始素材;分身功能仅限账户持有人本人形象使用,与 Google 账户绑定。

02它具体能做什么三个典型场景

📝 文本 + 草图 → 视频生成

  • 输入一句自然语言描述,附上一张照片或手绘草图作为参考。
  • Omni 混合文本与图像输入,生成与描述意图匹配的视频片段。

💬 对话式逐步修改编辑

  • 第一稿出来后,用日常语言描述要改的部分:「换个背景」「修正灯光」「加点特效」
  • 支持分步修改,每次只调整指定元素,不必从头重新生成整段视频。

🧑‍💼 数字分身替你播报出镜

  • 没时间化妆打光录视频?上传一张自拍 + 一段短语音,生成个人数字分身。
  • 输入要说的文字,分身即以你的形象和声音直接播报,适合快速视频更新、个性化问候。

03透明度机制:SynthID 水印

每一段由 Gemini Omni 生成的视频片段,都会嵌入不可见的 SynthID 数字水印。这一水印允许第三方验证视频是否由 AI 生成,旨在让用户在探索创作的同时,以可追溯的方式分享 AI 生成内容

生成片段嵌入 SynthID不可见水印可验证 AI 来源

注:SynthID 为 Google DeepMind 开发的数字水印技术,此前已应用于 AI 生成图像与音频,本次延伸至视频生成场景。

04编辑视角

关于这篇报道

本文信息源自 Google 官方产品博客,属企业通稿性质,所有功能描述与能力边界均由官方单方披露,未见第三方独立复测或对比评测。文中「high-quality」「easier than ever」等表述为官方营销措辞,读者宜带实测验证的预期去看——尤其是数字分身的真实度、Omni 编辑的稳定性,以及 SynthID 水印在多次转码后的存活率,这些都需要实际体验或第三方测评才能确认。

另外,官方未公布 Gemini Omni 的底座模型细节、生成时长、分辨率、单次生成上限等关键参数,产品能力上限目前是黑盒

当视频生成从「能做」走向「能改、能出镜、可追溯」,AI 视频正从一次性生成工具,演变为完整的个人内容生产流水线——这比模型参数提升本身,更接近改变大众创作方式的临界点。

现在就能用

Gemini Omni 与个人数字分身已上线 Google Vids,面向 Google AI Pro / Ultra 订阅用户及 Google Workspace 商业客户开放。数字分身功能限部分地区、18 岁以上用户。

前往 Google Vids → 体验 Omni 与数字分身