具身智能,是当下及代表未来的赛道之一——大家希望机器人不只"会想",更要"会做"。而要让机器人学会干活,研发及训练是第一步,是给它看足够多、足够真实的"人类怎么操作"的录像。
日前,创维数字旗下创维XR正式推出Ego(第一视角)具身数据采集产品体系,把创维数字深耕XR领域十二年打磨的整机能力,变成了一整套"生产机器人训练数据"的方案。
这不是一次赶热点的跨界,而是多年积淀、技术与产品积累的一次顺势而为的能力延伸。
为什么做这件事:机器人的"教科书"还太少
现在具身智能的全行业都在训练机器人,但高质量的人类操作数据极度稀缺。一个现实是:行业里流通的通用素材,真正能拿来训练AI模型的,有效占比不到5%。
问题出在采集端。一段好用的数据,要同时满足"看得清、定位准、多路同步、场景真实、链路完整"——任何一环掉链子,下游AI模型的上限就被锁死。行业共识是,质量必须前置到采集那一刻解决:硬件留下的底层缺陷,后期修补成本是前端的8到10倍,而且近40%的问题根本补不回来。
更尴尬的是"场地"。大多数采集设备必须连着外部主机、甚至架设基站,只能在实验室和摄影棚里转,带不进真实的酒店、家庭、工厂和办公室。可机器人将来要在真实世界里干活,训练数据却离真实环境很远——这正是当前行业最大的瓶颈。
创维数字的答案:把XR整机厂的本事,搬进数据采集
做Ego采集,最难的不是多装几个摄像头,而是让一套设备稳定地"戴在头上、跟着人走、把每一帧画面和位置都记准"。
而这,恰恰是XR厂商的看家本领。一台VR/MR/AR头显从出厂起,就要实时回答两个问题:我在哪、我在看哪。低延迟定位、多摄像头协同、画面与运动的时间同步,都是出厂自带的"基本功"。创维数字要做的,是把这套"记录版"的能力做扎实:把人在真实空间里每一刻看到什么、怎么动,完整、准确地存下来,让每一帧都落在统一的时空坐标里。
创维数字旗下创维XR在XR领域深耕十二年,这些软硬件及整机工程能力,早已在消费级市场被大量用户反复验证。如今,创维把它从"驱动画面"切换到"生产数据"——同一套技术体系,换了输出端。
产品矩阵:头戴 手腕 全身,一次采全
创维Ego数据采集产品体系,由四块组成,覆盖"从第一视角到全身动作"的完整记录:
创维E2/E6/E8头戴采集设备
多路摄像头协同,最大视场角达270°,把人眼前和手上的动作完整拍下;一体机设计,不用外接主机,戴上就能走进真实场景、即采即走。
腕部相机
戴在手腕上,和头戴设备微秒级时间同步,专门记录"手怎么动"——拿起、松开、触碰,一清二楚,补足第一视角缺的那块"操作细节"。
全身动捕模组
绑在双手和双腿上,一次采集全身动作,无需租用昂贵的专业动捕棚,就能拿到机器人学习"全身协调"所需的关键数据。
灯环定位模组
搭配创维E6&E8实现空间定位,无需使用外部定位基站,且支持接入第三方夹爪/手套追踪等外部感知设备。
三个"省心":为什么创维的方案更好用
对机器人公司和科研机构来说,这套方案的价值,可以归纳成三个"省心":
数据自带"位置坐标"
传统方式只记录画面,空间位置要后期花大价钱去算,而目前市面上的头戴数采设备精度误差常以厘米计。创维的方案在采集时就直接把空间轨迹算好,定位精度做到毫米级,省去漫长的后处理。
真实场景随便走
一体机形态,不挑场地——办公室、工厂、家庭都能采,让训练数据真正贴近机器人将来的部署环境,泛化能力更强。
多路数据自动对齐
头戴、手腕、全身空间定位模组的摄像头实时同步,视觉、位置、动作天然能融合,不用人工"对表",多模态数据开箱即用。
对创维XR意味着什么
具身智能被广泛视为AI下一个重要落地方向,而"高质量、可规模化的数据"是这条赛道里最稀缺的环节之一。
创维XR把十二年的XR技术积累,延展到这条高景气赛道,既是对原有能力的复用,也是面向未来的新增长曲线。从产品形态看,我们已形成"头戴采集 腕部 全身"的完整产品矩阵。
这背后,是一条清晰的逻辑:XR长期解决"设备如何理解真实空间",具身智能解决"如何记录人在真实空间里的状态"——两者应用不同,底层技术高度同源。整机思维,恰好对应数据采集闭环的每一个环节,也注定与未来规模化采集的需求更加契合。
从让画面不晕,到让机器人学会干活,底层是同一套"看懂空间、感知运动"的能力。
创维XR将继续秉持"开拓未来视界"的使命,把XR的深厚积淀,转化为具身智能时代的基础设施,也期待与更多产业链伙伴一起,把高质量的具身智能训练等数据做得更便宜、更完整、更接近真实世界


VIP复盘网