穹彻智能联合阿里云建成机器人数据生产线,吞吐提升 10 倍,训练效率提升 50%
机器人训练正从「人工加工」走向「工业化生产」。穹彻智能与阿里云联合打造的 UMI Data + AI Pipeline,将数据处理全流程自动化,吞吐提升超过 10 倍,模型训练效率提升约 50%,云端算力可弹性扩展至 10 万+ CU。
机器人训练正从「人工加工」走向「工业化生产」。穹彻智能与阿里云联合打造的 UMI Data + AI Pipeline,将数据处理全流程自动化,吞吐提升超过 10 倍,模型训练效率提升约 50%,云端算力可弹性扩展至 10 万+ CU。
对于具身智能而言,数据难题不仅在于「采不到」,更在于「处理不了」。
与大语言模型可以利用互联网海量文本不同,机器人需要学习的是现实世界中的操作能力。一次抓取、一段搬运、一场整理任务,都需要真实发生,并同步记录视觉、动作、轨迹等多模态信息。
穹彻智能采用 UMI(Universal Manipulation Interface)方案进行数据采集。操作人员只需手持设备完成抓取、开门、搬运等自然动作,设备便会同步记录第一视角画面、夹爪位姿、运动轨迹等信息。
但真正的挑战,往往发生在采集之后。
依赖单机 GPU 算力,视觉 SLAM 重建消耗巨大;鱼眼图像需逐帧去畸变;动作切分和语义标注大量依赖人工;数百小时视频数据带来巨大计算压力,任意环节中断可能导致整批数据重算。
分布式计算将任务拆分到云端并行执行;大模型实现自动语义标注;统一编排实现周期调度与异常自动恢复;算力按需弹性扩展,彻底打破单机瓶颈。
这些工作不仅计算量庞大,而且整个流程涉及多个处理环节,一旦某一步中断,就可能影响整批数据重新计算。对于具身智能企业来说,数据处理正在成为一项新的基础设施能力。
注:UMI 采集方案通过手持设备完成自然动作记录,同步输出第一视角画面、夹爪位姿与运动轨迹,为模型提供高质量多模态训练数据。
穹彻智能联合阿里云搭建了一套端到端的 UMI Data + AI Pipeline,把原本零散的数据处理流程,变成一条自动化运行的数据生产线。
在数据处理阶段,阿里云 MaxCompute MaxFrame 提供分布式计算能力,将视频去畸变、SLAM 位姿恢复、多模态标注等任务拆分到云端资源上并行执行。过去需要依赖单机完成的大规模计算,如今能够根据任务规模灵活扩展算力。
同时,大模型能力直接嵌入数据处理流程,实现动作片段的自动语义标注,大幅降低人工标注成本。
整个数据处理流程由 DataWorks 统一编排。无论是周期调度、历史数据重跑,还是异常自动恢复,都能够在统一平台完成,减少人工干预,让整条数据产线持续稳定运行。
完成处理后的数据,会进入 Hologres 进行统一管理,为后续样本检索、数据审核和训练管理提供实时的数据服务;随后再进入 PAI 平台完成模型训练、性能优化和部署验证,形成从数据生产到模型训练,再到效果反馈的完整闭环。
注:以上数据为穹彻智能与阿里云联合公开的实测结果,具体效果因任务规模与场景不同可能存在差异。
如果说 2025 年是具身智能爆发的一年,那么今年,行业竞争已经开始进入新的阶段。
从国内外越来越多机器人公司发布新产品,到资本持续加码,具身智能正成为 AI 领域最受关注的方向之一。但随着行业快速发展,一个共识正在形成:真正限制机器人进化速度的,不再只是模型,而是数据。
与大语言模型拥有互联网海量文本不同,机器人需要的是真实世界中的操作数据。一次抓取、一段搬运、一场整理任务,都需要真实发生,并同步记录多模态信息。如何持续获得高质量数据,并将这些数据快速转化为模型能够学习的数据集,是越来越多具身智能企业面临的新挑战。
穹彻智能与阿里云的这次合作,验证了一件事:机器人数据同样可以建立起规模化、自动化的数据生产体系。
当数据采集、处理、训练逐步形成标准化流程,机器人模型也将获得更快的迭代速度。随着行业竞争逐渐从模型能力延伸到数据基础设施,围绕数据生产能力的探索,也将成为下一阶段具身智能发展的重要竞争力。
具身智能的竞争正在从「模型能力」转向「数据基础设施」——谁先建成工业化数据生产线,谁就掌握了机器人迭代的节奏。
穹彻智能与阿里云联合打造的 UMI Data + AI Pipeline 已投入实际使用。关注阿里云 AgentNative 数据实战录系列案例,获取更多技术细节。
阿里云官方 → 了解更多