📷 智能物联 · WAIC 2026 观察
海康威视 WAIC 首秀:把 2B 大模型塞进摄像机,用「多快准省」给物理 AI 定标准
在 WAIC 2026 上,AIoT 巨头海康威视首次深度亮相,一口气展出上千款大模型软硬件产品。它的叙事核心不是参数,而是以「观澜大模型」为底座的一套「多、快、准、省」体系——回答大模型进入物理世界最难的四件事:感知覆盖、行业适配、复杂环境可靠性、规模化成本。
来源:公开报道•
WAIC 2026 · 上海世博展览馆•
全文约 4 分钟读完
#海康威视
#观澜大模型
#WAIC2026
#物理AI
#智能物联
1000+ 款
大模型软硬件产品 · 云边端全覆盖
2B
端侧摄像机大模型参数(2025 年初为 0.3B)
594.54亿元
近六年累计研发投入,费用率保持 10%+
⚡ 30 秒速览
- 首秀分量:海康威视首次深度参展 WAIC,以上千款大模型产品展示「观澜大模型 + 云边端」的智能物联体系,释放三个产业信号。
- 信号一 · 四字标准:「多快准省」对应落地四难——十余种传感技术、适配周期月级→半天、周界误报率降 90%+、端边云协同控成本。
- 信号二 · 全线改写:前端摄像机端侧模型一年从 0.3B 做到 2B;后端「文搜」视频检索一年卖出约 10 万套,海外与国内首次同步起量。
- 软件实战:应急指挥智能体在宁夏应急厅项目中,接报响应时效提升约 45%,指挥体系呼叫时效提升约 300%。
- 信号三 · 底牌:传感矩阵 × 90 多行业场景知识 × 软硬协同闭环,构成「感知-分析-优化-执行」数据飞轮。
- 阅读提示:文中效果数据均为企业单方口径,未见第三方复测——请先看下方的「编辑视角」。
✎ 编辑视角 · 读前须知
- 信源结构:本篇是行业媒体的探展报道,核心信息几乎全部来自海康威视相关负责人采访与展台演示,属典型的「企业主导叙事」,缺少客户与独立第三方的交叉印证。
- 数据口径:误报率降 90%、微孔检出 99.99%、适配「月级→半天」、文搜年销约 10 万套、宁夏项目效率提升等关键数字,均为企业单方口径,报道中无第三方复测。
- 原文瑕疵:原文称「授权有效专利 12981 万件」系明显笔误(应为 12,981 件,其中发明专利 7,399 件),本页已按此修正并加注。
- 建议读法:把它当作一份高信息密度的「厂商能力宣示」——0.3B→2B、半天适配、文搜销量这类指标是可证伪的,值得记录,留待客户侧反馈与第三方 benchmark 检验。
01信号一:物理 AI 的硬标准是「多快准省」对应落地四难
大模型进物理世界,先撞上一个根本问题:它从未真正「活」在物理世界里。WAIC 主论坛上,复旦大学浩清特聘教授苏昊的表述被反复引用:
「人类摔过跤、摸过烫的杯子、接不住掉下来的球,才把这些经验压缩成语言。但大模型从出生开始,学的就只是这道『影子』——它读遍了互联网上的文字,却没有感受过重量、摩擦、重力,没有为自己的错误判断付出过『摔碎杯子』的代价。」
—— 苏昊 · 复旦大学浩清特聘教授、通用物理智能研究院院长,WAIC 2026 主论坛演讲
海康展台工作人员对行业媒体的描述同样直白:「互联网世界的数据相对标准化……但物理世界充满变化:光照会变化,环境会变化,设备状态会变化,人的行为也会变化。」工厂安监不只是判断「有没有人」,还要理解是否在动火作业、安全距离是否合规、防护装备是否完整。观澜大模型的答案,被概括为四个字:
多
感知覆盖:物理世界的「眼耳鼻舌身意」
- 覆盖可见光、红外、X 光、毫米波、音频、多光谱等十余种传感技术;构建视觉 / 音频 / X 光 / 毫米波 / 光纤大模型矩阵。
- 高速边坡监测:视频 × 卫星 / 雷达多模态交叉验证,减少小目标、暗光、恶劣天气下的漏检误检。
- TDLAS 气云成像遥测仪:融合激光监测、气云成像与可见光,让不可见的气体泄漏在画面中「显形」。
微漏识别率 90% 以上
快
行业适配:碎片场景的交付速度
- 传统方式新场景要重新采数据、训模型、部署测试,周期以月计。
- 观澜基于海量数据预训练,具备零样本 / 小样本理解能力,仅需数张至数十张目标样本微调即可完成适配。
- 对追求柔性制造的工厂,意味着时间成本与试错成本的大幅节约。
适配周期:月级 → 半天
准
复杂环境下的可靠:从「看得清」到「看得懂」
- 周界防范误报率降低 90% 以上;工业微孔缺陷检出率 99.99%;安检 X 光检出率 97% 以上。
- AI 多模态安全作业主机:动火作业中综合判断作业票据、气瓶间距、防护装备与空间逻辑,从机械告警升级为智能研判。
- 物理世界的「准」没有退路——一次误判可能关乎生产安全乃至人命。
从机械告警 → 智能研判
省
规模化成本:投入产出比是生死线
- 端边云三层协同:简单场景在端侧解决,复杂任务交给云端,不为每个场景堆砌高算力服务器。
- 配合模型压缩、知识蒸馏、Token 优化等推理优化技术,控制部署成本与带宽开销。
- 无网无电的农田、水库监控点:前端边缘计算仅回传报警图片或几秒钟关键视频,连太阳能供电配置压力都随之降低。
省带宽 · 省供电 · 省算力
注:以上识别率、误报率、适配周期均为海康威视向媒体披露的口径数据。「多快准省」分别对应规模化落地的覆盖广度、交付速度、可靠性与经济性。
02信号二:全产品线被大模型改写前端 · 后端 · 软件
📷 前端:摄像机从「记录者」进化为「现场智能体」端侧 0.3B → 2B
- 「2025 年前,将大模型放在前端是我们想都不敢想的事。」——2025 年初的大模型周界相机约 0.3B 参数;如今已做到 2B,并实现毫秒级实时响应。负责人称更大参数进摄像机「非常有可能」。
- 三重升级:交互——从专人编写复杂规则到用户直接说出需求;理解——从「有一群人」到「他们在游泳,存在溺水风险」;决策——不只报警,主动联动声光、门禁形成闭环处置。
- 背后是全栈软硬协同:芯片选型、功耗控制、散热设计、镜头与云台机械联动全部自研,才把数十亿参数塞进功耗体积受限的机身。海康第一款摄像机发布于 2007 年,「看得清、看得全、看得懂」的目标被大模型重新定义。
🔍 后端:录像库变成能「文搜」的视频数据库年销约 10 万套
- 「找一段录像像大海捞针」是行业长期痛点:过去要提供精准的时间、地点或明确目标特征。
- 文搜基于图文多模态大模型实现「用文字,秒搜图」——输入「穿蓝色上衣背背包的人」「红色电瓶车」,海量录像中秒级定位片段。
- 业务负责人透露:文搜发布一年售出约 10 万套;海外起量超出预期,出货与国内基本持平——以往是国内先行、海外复制,这次是同步起量。
🧩 软件:「1+3+X」体系,从「人找功能」到「一句话调度业务」90+ 行业平台
- 1 个大模型基座 + 3 类应用(智能工具 / 智能应用 / 智能体)+ X:90 多个细分行业软件平台。
- 应急指挥智能体:一句话调视频、创会议、识隐患、查资源、发指令、打电话。负责人称,智能体改造后平台使用负荷与培训成本大幅降低。
+45%突发事件接报响应时效
+83%信息处理与系统操作效率
+300%指挥体系呼叫时效
- ChatBI 数据分析智能体:「只要会打字,就能进行数据分析研判」——一句「分析各社区能耗并生成可视看板」,自动完成查询、建模、报表,数据分析效率提升超 80%。
- 软硬协同的差异点:普通行业软件只能分析结构化数据,海康智能体还能调度相机取回真实世界数据,形成从数据采集到决策执行的闭环。
注:三组效率数字来自企业在宁夏应急厅实战项目中披露的口径,ChatBI 效率提升亦为企业口径。
03信号三:抢滩物理 AI 基础设施,海康的三张底牌
①
感知产品矩阵:物理世界数字化的第一步
一位长期关注 AIoT 的资深人士指出,这是海康最明显的特点——如果无法获取高质量的物理信号,再大的模型也只是空中楼阁。海康的战略从安防演进为智能物联,卡位的正是这个入口。
②
行业场景知识:90+ 垂直行业、2000+ 场景
海康方人士称,一线需求须经充分市场调研与立项评审,确保新产品为解决实际问题而生,而非为了 AI 而 AI。垂类模型因此能「既精准又高性价比」地解决场景问题。
③
软硬协同闭环:从传感器芯片到行业应用的全栈
产业链人士分析:许多通用大模型厂商落地时困于「最后一公里」——缺乏对物理执行设备的控制能力。海康全栈自研让数据在系统内高效流动,形成越用越聪明的飞轮:
感知→分析→优化→执行
家底同样关键:AI 投入已持续二十年——
- 2006组建智能算法团队,AI 投入起点
- 2019AI 开放平台被科技部授予「视频感知」国家新一代人工智能开放创新平台
- 2023观澜大模型发布,通过中国信通院「可信 AI 大模型能力评测」,模型开发能力获业内首个 5 级评分
- 2026上千款大模型软硬件产品,云边端全覆盖,WAIC 首次深度亮相
594.54亿近六年研发投入(元)
10%+研发费用率
2.6万研发及技术服务人员(占近 50%)
1.3万*授权有效专利(发明专利 7,399 件)
*原文「授权有效专利 12981 万件」系笔误,本页按 12,981 件计;数据截至 2025 年底,引自官方财报口径。
编辑核心判断
大模型下半场拼的不是参数,而是谁能在现实世界「贴地飞行」——而贴地飞行的门票(传感矩阵、行业 know-how、执行端闭环),恰恰是互联网式 AI 公司最难补的三门课。