|人形智能数据采集利器|
德塔全身全景数据采集新范式
人形机器人的智能,究竟从哪里来?
语言大模型的答案早已写在 Scaling Law 里:数据的规模与质量,直接决定模型能力的上限。
但具身智能面临着比语言模型残酷得多的现实 —— 互联网上没有现成的 “人类动作数据”。
人类几千年的文明留下了浩如烟海的文字与图像,却几乎没有留下一条可供机器人学习的完整动作轨迹:我们如何转身、如何弯腰、如何伸手抓住一只杯子、如何在行走中避开桌角 —— 这些人类习以为常的身体智慧,从未被系统性地记录过。
而现有的采集手段,各有各的天花板:
●真机遥操作:一台本体动辄数十万元,采集效率受限于本体数量与遥操作熟练度,规模化成本极高;
●动捕棚方案:光学动捕精度虽高,但场地固定、部署繁琐,采到的是 “实验室里的动作”,缺乏真实环境的视觉上下文;
●仿真合成:Sim-to-Real 的鸿沟始终存在,模型在仿真里学得再好,落到真实世界依然水土不服。
数据量少、成本高、离真实场景远 —— 这是横亘在整个具身智能行业面前的共同难题。
如何低成本、规模化地采集真实场景中 “人怎么看、人怎么动” 的完整数据? 德塔智能给出了自己的答案。
01
Delta D1:戴上即采
全景视觉 +全身骨骼一次采齐
德塔智能正式发布头戴式全景全身数据采集设备 Delta D1—— 无需机器人本体、无需动捕棚、无需改造场地,一台轻量化头环,同时采集第一人称全景视觉与全身骨骼运动两类核心数据,开创 “作业即采集” 的数据生产新范式。

人在真实环境中自然地工作、行走、操作,D1 在头顶安静地记录下一切。
采集者不需要学习任何操作技能,不需要中断手头的动作 —— 你只管作业,数据自然发生。
一颗 “全景之眼”:完整复刻人类视界
D1搭载多相机混合现实传感系统:
・220° 超广角 4K 主相机(800 万像素 / 60fps)—— 视场角超过人类双眼的自然视野,完整捕捉第一人称视角下的环境全景与操作过程;
・双 160° 广角 2K 副相机(500 万像素 / 30fps)
—— 左右两翼扩展视野覆盖,与主相机互补,抓取、接触、遮挡等关键操作细节尽收眼底,彻底消除视觉盲区。

一套 “骨骼引擎”:高精度还原全身动作
这是 D1 与市面上第一视角采集方案真正拉开差距的地方 ——
D1 内置4K高清超广角相机 + IMU 高精度定位模组,在采集视觉画面的同时,实时解算佩戴者的全身人体骨架数据与空间定位轨迹,全局坐标定位精度控制在 2cm 以内。
这意味着,D1 输出的不只是 “人眼看到了什么”,更是 “人的身体做了什么”:每一次转身、弯腰、下蹲、伸展,每一段行走轨迹,都被完整记录为可供算法直接使用的结构化骨骼数据。

全模态同步,采完即可用
一次佩戴,D1 同步输出五类数据流:
●RGB 图像 |多路高清相机
●全身人体骨架数据 | 全身关节点运动轨迹
●空间定位轨迹 | 全局定位精度 2cm 以内 & IMU 数据
●麦克风音频 | 内嵌麦克风,支持空间音频录制
多路传感器严格时序同步、帧率精准对齐,“看到的” 与 “做到的” 在时间轴上完全咬合。数据可直接用于人形机器人的动作学习与真机复刻回放,无需二次对齐修补。
为长时作业而设计
・轻量化头戴形态 —— 无背包、无线缆束缚,长时间佩戴无压迫感,日常作业零干扰;
・换电式续航 —— 标配多块电池 + 充电基站,即换即用,支持全天候不间断采集;
・强悍算力底座 —— 瑞芯微 RK3588 处理器,Wi-Fi 6 + 蓝牙 5.3 + Type-C 3.2 全速连接,标配 1TB 存储,海量数据从容吞吐。
02
D1-Gripper:把 “手上功夫” 也采下来

D1 - Gripper 上的 220° 广角 4K 相机与定位模组近距离捕捉人类抓取、对准、装配等末端操作细节,并与头戴 D1 协同工作 —— 头上一台看全局,手上两台盯细节,全局环境与末端交互在同一时间轴上完整留存,双臂操作数据一次采齐。

03
三类核心数据 喂饱 “大脑” 与 “小脑”
源自:Delta Intelligence 德塔智能
-END-
2025年,人形机器人产业迎来爆发拐点。特斯拉Optimus量产在即,华为、宇树等企业加速技术突破,行业正从“实验室研发”向“规模化落地”跃迁为打通产业链上下游协作壁垒,艾邦机器人正式组建"人形机器人全产业链交流群",覆盖金属材料、复合材料、传感器、电机、减速器等全硬件环节,助力企业精准对接资源、共享前沿技术!
扫码关注公众号,底部菜单申请进群




