🎬 视频模型 · 开源先锋

MiniMax H3 登顶视频编辑榜,价格仅为 Seedance 三分之一,宣布开源

7 月 22 日,MiniMax 发布视频旗舰模型 H3,以 1130 Elo 登顶 Artificial Analysis 视频编辑榜,力压 Google Gemini Omni、字节 Seedance 2.0 等模型。价格仅为 Seedance 2.0 的 三分之一,且即将开源——这是第一个达到旗舰水平的开源视频模型。

综合公开信息整理 2026-07-23 全文约 4 分钟读完
#MiniMax #H3 #视频生成 #开源 #多模态
🥇 第 1 名 Artificial Analysis 视频编辑榜
1130 Elo 领先 Gemini Omni 与 Seedance 2.0
1/3 价格 仅为 Seedance 2.0 的推理成本

⚡ 30 秒速览

  • 赢了多少:1130 Elo 登顶视频编辑榜,领先 Google Gemini Omni、字节 Seedance 2.0 等闭源旗舰。
  • 价格击穿:H3 推理成本仅为 Seedance 2.0 的 1/3,商业场景每月可节省数十万级调用费用。
  • 开源决定:即将开源权重,是业内第一个达到旗舰水平的开源视频模型,可私有化部署。
  • 能力定位:全模态统一——文本、图片、音频、视频同上下文,一次生成接近商业成片的完整内容。
  • 核心差异:不是"能生成画面",而是"能交付成品"——编辑、文字、声音、包装一体完成。

01实力与价格的双重突破 榜单与成本数据

Artificial Analysis 最新视频编辑排行榜中,MiniMax H3 以 1130 Elo 占据榜首。榜单涵盖 Google Gemini Omni、字节 Seedance 2.0、Runway Gen-4 等数十个模型,H3 在画面编辑、文字稳定、多模态一致性等维度上综合领先。

1130 Elo 评分 · 榜单第1
1/3 Seedance 2.0 价格
7 编辑能力维度
1st 开源旗舰视频模型

注:Elo 评分基于 Artificial Analysis 视频编辑专项榜单,分数越高代表综合编辑能力越强。价格对比为 H3 与 Seedance 2.0 的 API 推理成本比值,非终端定价。

但榜单排名只是冰山一角。真正让行业侧目的,是 H3 将旗舰级模型能力与 1/3 的推理成本结合在一起。对于需要高频生成、快速迭代的商业场景(广告创意、电商展示、短剧制作),这意味着单位内容的生成成本大幅下降,试错空间显著扩大。

Seedance 2.0(闭源旗舰)

画质与一致性优秀,但价格较高;企业需通过 API 调用,数据需上传至第三方,存在隐私顾虑。

MiniMax H3(开源旗舰)

效果比肩 Seedance 2.0,价格仅为 1/3;支持私有化部署,数据不出域,可定制微调。

注:对比基于公开评测与官方定价信息,实际效果因场景而异。H3 开源后企业可自行部署测试。

02它到底能做什么? 三大差异化能力

H3 不是"又一个能生成视频的模型"。它的核心差异在于:把视频生成从素材级推向交付级。以下三项能力,每一件都是商业视频生产中的真实痛点。

🎯 全模态精准编辑 换人 · 换物 · 改光影

  • 支持在已有视频上完成 换人、换物、换背景、绿幕合成、改台词、调光影 和视频续写等操作。
  • 编辑结果保持画面连续性和物理一致性,不会出现闪烁或变形。
  • 过去需要后期软件逐帧调整的工作,现在一句自然语言即可完成。
实测表现:画面一致性高,光影过渡自然,绿幕边缘无锯齿。可替代部分后期环节。

📝 复杂文本保持与视觉融合 片头字幕 · UI 文字 · 动态海报

  • 视频中的文字在连续帧中保持 稳定、清晰、不变形,不漂移不闪烁。
  • 电影片头字幕、产品 UI 文字、动态海报排版等场景中表现突出。
  • 文字与画面光影、背景深度融合,而非简单叠加。
这是视频模型长期以来的痛点——H3 在文字稳定性上达到可用级别,对品牌广告和产品展示场景意义重大。

🎬 一站式成片 画面 + 声音 + 文字 + 节奏

  • 将画面生成、声音生成、文字呈现和镜头节奏整合在 同一模型 中。
  • 用户无需依赖额外后期处理流程,即可获得接近交付标准的完整视频片段。
  • 声音不再区分人声、音效和音乐,模型统一理解并同步生成。
海外开发者 @hasantoxr 测试:H3 可为实拍视频增加手绘发光动画,通过自然语言描述即可指挥动画路线,匹配场景光线并保留真实光影关系。

把分散在后期流程中的能力塞进一个模型——这是 H3 最直接的"交付级"信号。

03技术底座:如何统一多模态? 四项核心技术

H3 的技术目标很明确:任务的统一与泛化。它用语言作为桥梁,将文生图、图生视频、视频编辑、声音生成等能力纳入同一个预训练范式,而非堆叠多个专家模型。

Contextual Omni Representation H3-VAE H3-Omni Transformer In-context Regeneration

四块技术拼图各司其职:

Contextual Omni Representation 增强多模态描述能力,让模型理解素材之间、素材与目标之间、画面与声音之间的关系 —— 这是"全模态上下文"的根基。

H3-VAE 升级视频 tokenizer,在重建质量和压缩效率上获得 4 倍序列长度收益,是 H3 支持 原生 2K 输出 的关键。

H3-Omni Transformer 采用理解与生成异构的训练架构,通过样本间负载均衡将端到端训练吞吐提升近 30%。

In-context Regeneration 与传统专用超分模块不同,让基模基于低分辨率结果和上下文信息重新生成 2K 细节,提升小文字、纹理和画面细节的还原能力。

注:技术细节引自 MiniMax 官方技术博客,四项技术共同构成 H3 的"统一泛化"能力基础。

04H3 卡在哪个转折点上? 视频生产工具的演进

要理解 H3 的位置,得先看过去十多年视觉内容生产工具的跃迁。H3 所处的节点,正是视频模型从 素材生成走向商业级成片交付 的关键拐点。

2010s · 专业软件时代

Photoshop + Premiere + After Effects + DaVinci

一条十几秒的广告短片需要设计、剪辑、后期、动画师等多角色协同,制作成本极高。能力足够强,但门槛和协作成本是硬伤。

2016~2020 · AI 辅助工具

自动抠图、智能修图、视频补帧、内容识别填充

AI 以效率插件形态嵌入既有软件,减少重复劳动,但仍是"辅助"而非"创作"。

2021~2023 · 图像生成模型爆发

Midjourney · Stable Diffusion · 开源生态

Stable Diffusion 的开源催生了 LoRA、ControlNet、ComfyUI 等完整生态,证明了"强开源底座 = 生态底座"的公式。

2023H2~2025 · 视频生成从 Demo 到素材

Runway · Pika · 可灵 · 海螺 · Vidu · Seedance

分辨率提升、时长变长、运动稳定性改善。但大部分模型仍停留在"素材级"——生成一段画面后,还需回到剪辑软件做包装、字幕、调色、合成和音效。

2026 · 转折点:H3 发布

从"生成素材"到"接近交付"

H3 将画面生成、声音生成、文字呈现和镜头节奏整合在同一模型中,让用户无需依赖额外后期流程即可获得交付级片段。这不只是能力的叠加,而是生产范式的变化。

过去 AI 视频的价值是"能不能生成",现在行业真正关心的是"能不能交付"。H3 要回答的,正是后一个问题。

05开源才是真正的变量 从闭源竞争到生态竞争

如果说 H3 的"交付级"能力是它的本分,那么 开源 才是它试图撬动行业格局的杠杆。视频生成领域,头部模型开源权重,这是第一次。

造成这一现象的原因不难理解:视频模型的训练成本、推理成本、数据组织和工程复杂度远高于文本与图像模型——越接近旗舰能力,厂商越倾向于用闭源 API 回收成本。此前的开源视频模型(万相、混元视频、LTX)与 Seedance 等闭源旗舰之间,行业普遍认为存在能力差距。H3 的出现,第一次弥合了这道鸿沟。

🏢 企业侧:私有部署,数据可控

广告、影视、游戏、电商行业的视频生产涉及未公开产品、品牌资产、商业脚本。上传到第三方闭源模型意味着 数据外流与知识产权风险。H3 开源后,企业可私有化部署,将模型放在自己的服务器或私有云中运行,数据不出域,安全可控。

🌱 生态侧:可定制,可扩展

视频生产并非标准化场景。电商关注商品准确性,游戏关注角色一致性,短剧关注人物连续性。开源后,企业和开发者可以基于 H3 微调、适配和二次开发,训练更懂特定场景的行业版本,也可将其嵌入剪辑工具和创作平台,形成一体化工作流。

图像生成领域已经证明:强开源底座 = 插件生态 + 微调模型 + 工作流模板 + 行业应用。若视频领域也出现类似底座,围绕 H3 的推理优化、风格模型、行业插件和创作工具链可能随之形成。视频模型的竞争,正在从 闭源旗舰之间的单点能力比拼,进入 开放生态与产业落地能力的综合竞争

注:开源时间与具体许可协议以 MiniMax 官方公告为准。企业部署需自行评估硬件与运维成本。

编辑核心判断

视频生成行业正在经历从"能不能生成"到"能不能交付"的范式转换。H3 以开源姿态将旗舰能力交到产业手中,真正改变游戏规则的,不是单点能力的领先,而是生态开放带来的产业渗透速度。

关注进展

H3 即将开源,模型权重与评测流程将面向开发者开放。关注 MiniMax 官方渠道获取最新发布信息。

minimax.io → 关注开源