💰 融资 · 多模态赛道

智象未来三个月连融 21 亿跻身独角兽,多元资本押注原生全模态新路径

7 月 23 日,智象未来(HiDream.ai)宣布完成 15 亿元 C 轮融资,近三个月内三轮累计融资超 21 亿元,估值突破 10 亿美金。社保基金、工银资本首次出手多模态赛道,上影、华策两家头部影视公司并肩入局——不同属性资本罕见同框,押注的是同一条技术路线:从视觉像素出发构建原生全模态世界模型。

来源:公开报道 2026-07-24 全文约 4 分钟读完
#智象未来 #多模态 #世界模型 #C轮融资
🦄 独角兽 估值突破 10 亿美金 · 近 3 个月 3 轮
21亿 累计融资额(近三个月三轮)
15亿 C 轮单轮 · 多元资本联合领投

⚡ 30 秒速览

  • 融了多少:C 轮 15 亿元,近三个月三轮累计超 21 亿元,估值破 10 亿美金,正式跻身全球 AI 独角兽。
  • 谁在投:社保基金、工银资本首次出手多模态赛道;上影、华策两家头部影视上市公司并肩入局;合肥产投等老股东持续加注。
  • 技术叙事:不走「语言模型外挂图片模块」的缝合路线,自研 UiT 架构,用同一套 Transformer 处理图像、文本、视频、音频等原始信号。
  • 第三方验证:旗下 HiDream-O1-Image 以「Peanut」匿名登顶 Artificial Analysis 文生图开源榜第一,商用版位列全球前三。
  • 商业化进度:核心产品 vivago R1 视频商用成功率 85%,海外版覆盖 100+ 国家、超 5000 万用户。

01四类资本同框 不同属性资金看到不同价值锚点

一家 AI 创业公司融资轮次越往后,股东构成通常会趋于收敛。智象 C 轮却呈现相反图景——国家级资本、产业方、市场化 VC、地方国资在同一轮密集出现:

🇨🇳 国家级资本

社保基金(四川振兴科创基金)首次以 LP 身份投多模态;工银资本首次出手该赛道。关注的是技术路线的战略意义。

📈 市场化 VC

敦鸿资本、弘颐资管、东方富海等顶级机构集体入局,多家首次布局视觉大模型赛道,基于硬核技术落地价值的专业判断。

🎬 影视产业方

上影股份、华策影视并肩入局,已达成新型内容创制、院线升级、AI 跨屏整合营销等合作——卡位内容产业革命

🏛️ 地方国资

安徽、上海、浙江、福建、湖南多地国资跟投。合肥产投持续加注——这座城市曾反复在行业黎明期下重注长鑫科技、京东方。

老股东合肥产投、东方富海、金浦投资、金华金投、中哲创、财鑫资本持续加注。跟投方还包括厦门国贸资本、上影新视野基金、湖北长江产业投资集团、航源资本、创云海资本、华福投资、余杭金控股份、交银资本、若松基金等。

02缝合架构 vs 原生全模态 一条路线分歧

杨立昆曾判断:三到五年内,世界模型将取代 LLM 成为主流 AI 架构。底层逻辑是——大语言模型的智能被局限在人类已编码的符号系统内,而世界模型要让 AI 理解物理世界中的空间、时间、因果和交互。

传统多模态:缝合架构

语言模型外挂图片理解模块,再补生成模块,各模态分别编码、外层拼接。文字是主轴,其他模态是插件,信息每次转换都在损耗。

智象 UiT:原生全模态

图像像素、文本 Token、视频体素、音频、动作、空间关系等原始信号,由同一套 Transformer 完成理解、生成和推理。

UiT 架构的关键设计:不设独立文本编码器,不用 VAE 作为模态间传导介质,所有信号统一 tokenization,端到端在同一网络中完成文生图、长文本渲染、指令编辑、主体驱动、故事板生成等多任务处理。

视觉像素统一 Tokenization单一 Transformer端到端多任务

03榜单坐标 Artificial Analysis 文生图榜

2026 年 5 月,智象旗下 HiDream-O1-Image(8B 参数开源版)以「Peanut」匿名登榜全球知名独立 AI 模型评测平台 Artificial Analysis,拿下开源模型第一,是榜单前 20 名中参数最小的版本。商用版 1.5 随后位列全球前三

🥇 HiDream-O1-Image智象未来 · 开源 8B
第 1
闭源模型 A海外厂商
第 2
HiDream-O1-1.5 商用版智象未来
第 3

注:榜单排名变动周期正从季度缩短到月度,坐标意义大于终局判定。智象在光影、复杂构图、指令跟随和中英文字渲染维度表现突出,具体分数以 Artificial Analysis 官方为准。

04一段「荒诞科幻片」比 SOTA 更有说服力的试金石

智象已搭建「1+1+3」商业化体系:HiDream 全模态底座 + HiHarness 企业能力中台 + 三大垂直场景智能体。WAIC 重磅发布的 vivago R1 是核心标杆——全球首款支持无限时长视频自主生成与编辑的创作智能体。

底座

HiDream 大模型

承载底层技术创新与算力支撑

中台

HiHarness

标准化能力输出,适配企业定制

应用

三大场景智能体

商业营销 / 影视创作 / 社媒创作

🎬 风格试金石:叶什尔查姆荒诞科幻片商用成功率 85%

  • 有用户输入刁钻指令:生成一部「叶什尔查姆风格」荒诞科幻短片——土耳其上世纪六七十年代低成本商业电影,以硬纸板怪兽服、泡沫塑料石头、手绘外星球背景著称。
  • 对 AI 视频模型,这要求理解「不完美」:既要输出符合物理规则的画面,又要刻意保持低成本质感,在「假」与「可笑」之间精确踩中风格阈值。
  • 多数模型倾向输出「好看画面」而非「对的风格」。vivago R1 被创作者社群评价为「精准捕捉到了那种荒谬感」——硬纸板怪兽、手绘背景、廉价特效质感均被复现,镜头间叙事逻辑保持连贯。
技术支撑:长链路叙事规划 → 整体脚本与镜头规划 → 分段生成 → 智能纠错 → 单段失败独立重试。商用有效成功率 85%,跨过企业规模化商用门槛。

海外版已覆盖 100+ 国家和地区、累计服务 超 5000 万用户,今年 5 月灰度版登顶 Product Hunt 日榜第一,被硅谷知名 product hunter Chris Messina 评价为「Think Claude Code, but for video」。

编辑视角

本篇核心信息源自企业通稿与公开报道,融资细节已有工商信息可佐证,但「85% 商用成功率」「5000 万用户」等运营数据为单方披露,未见第三方独立复测;榜单排名基于 Artificial Analysis 单一平台、特定时间窗口,视觉模型排名变动周期已缩短至月度,读者宜将坐标意义视作快照而非终局。

多元资本同框本身不构成技术路线成立的证明——社保基金与工银资本的「首次出手」更可能反映国资在 AI 视觉赛道布局稀缺的补位需求,而非对 UiT 架构的成熟判断。真正值得追踪的信号是:大语言模型估值溢价见顶后,资本正在物理智能方向寻找下一个锚点,智象只是这条新赌桌上较早摊牌的玩家之一。

当资本共识从「模型知不知道」转向「智能体能不能把整件事做完」,世界模型赛道的牌桌才刚刚摆开——这场比赛比的不是谁的参数更大,而是谁先交出可被第三方验证的物理世界推演答卷。

现在就能用

vivago 海外版已覆盖全球 100+ 国家,HiDream-O1-Image 开源版可在 GitHub 获取。

hidream.ai → 官网体验