|人形智能数据采集利器|

德塔全身全景数据采集新范式

 

 

人形机器人的智能,究竟从哪里来?

 

语言大模型的答案早已写在 Scaling Law 里:数据的规模与质量,直接决定模型能力的上限。

 

但具身智能面临着比语言模型残酷得多的现实 —— 互联网上没有现成的 “人类动作数据”。

 

人类几千年的文明留下了浩如烟海的文字与图像,却几乎没有留下一条可供机器人学习的完整动作轨迹:我们如何转身、如何弯腰、如何伸手抓住一只杯子、如何在行走中避开桌角 —— 这些人类习以为常的身体智慧,从未被系统性地记录过。

 

而现有的采集手段,各有各的天花板:

 

●真机遥操作:一台本体动辄数十万元,采集效率受限于本体数量与遥操作熟练度,规模化成本极高;

●动捕棚方案:光学动捕精度虽高,但场地固定、部署繁琐,采到的是 “实验室里的动作”,缺乏真实环境的视觉上下文; 

●仿真合成Sim-to-Real 的鸿沟始终存在,模型在仿真里学得再好,落到真实世界依然水土不服。

 

数据量少、成本高、离真实场景远 —— 这是横亘在整个具身智能行业面前的共同难题。

 

如何低成本、规模化地采集真实场景中 “人怎么看、人怎么动” 的完整数据? 德塔智能给出了自己的答案。

 

01 

Delta D1:戴上即采

全景视觉 +全身骨骼一次采齐

 

德塔智能正式发布头戴式全景全身数据采集设备 Delta D1—— 无需机器人本体、无需动捕棚、无需改造场地,一台轻量化头环,同时采集第一人称全景视觉全身骨骼运动两类核心数据,开创 “作业即采集” 的数据生产新范式。

图片

人在真实环境中自然地工作、行走、操作,D1 在头顶安静地记录下一切。

 

采集者不需要学习任何操作技能,不需要中断手头的动作 —— 你只管作业,数据自然发生。

 

 

  一颗 “全景之眼”:完整复刻人类视界

 

D1搭载多相机混合现实传感系统: 

 

・220° 超广角 4K 主相机(800 万像素 / 60fps)—— 视场角超过人类双眼的自然视野,完整捕捉第一人称视角下的环境全景与操作过程;

 

・双 160° 广角 2K 副相机(500 万像素 / 30fps)

—— 左右两翼扩展视野覆盖,与主相机互补,抓取、接触、遮挡等关键操作细节尽收眼底,彻底消除视觉盲区。

 

图片

 

  一套 “骨骼引擎”:高精度还原全身动作

 

这是 D1 与市面上第一视角采集方案真正拉开差距的地方 ——

 

D1 内置4K高清超广角相 + IMU 高精度定位模组,在采集视觉画面的同时,实时解算佩戴者的全身人体骨架数据与空间定位轨迹,全局坐标定位精度控制在 2cm 以内。

 

这意味着,D1 输出的不只是 “人眼看到了什么”,更是 “人的身体做了什么”:每一次转身、弯腰、下蹲、伸展,每一段行走轨迹,都被完整记录为可供算法直接使用的结构化骨骼数据。

 

图片

 

  全模态同步,采完即可用

 

一次佩戴,D1 同步输出五类数据流:

 

●RGB 图像 |多路高清相机

●全身人体骨架数据 | 全身关节点运动轨迹

●空间定位轨迹 | 全局定位精度 2cm 以内 & IMU 数据

●麦克风音频 | 内嵌麦克风,支持空间音频录制

 

多路传感器严格时序同步、帧率精准对齐,“看到的” 与 “做到的” 在时间轴上完全咬合。数据可直接用于人形机器人的动作学习与真机复刻回放,无需二次对齐修补。

 

  为长时作业而设计

 

・轻量化头戴形态 —— 无背包、无线缆束缚,长时间佩戴无压迫感,日常作业零干扰;

・换电式续航 —— 标配多块电池 + 充电基站,即换即用,支持全天候不间断采集;

・强悍算力底座 —— 瑞芯微 RK3588 处理器,Wi-Fi 6 + 蓝牙 5.3 + Type-C 3.2 全速连接,标配 1TB 存储,海量数据从容吞吐。

 

 

02

D1-Gripper:把 “手上功夫” 也采下来

面向双臂精细操作场景,德塔同步推出 D1 的手持末端配件 — D1-Gripper 手持末端数据采集器。

图片

D1 - Gripper 上的 220° 广角 4K 相机与定位模组近距离捕捉人类抓取、对准、装配等末端操作细节,并与头戴 D1 协同工作 —— 头上一台看全局,手上两台盯细节,全局环境与末端交互在同一时间轴上完整留存,双臂操作数据一次采齐。

 

图片

 

03

三类核心数据 喂饱 “大脑” 与 “小脑”

一人一套 D1系统,即可产出具身智能最稀缺的三类核心数据

 

第一人称全景环境视觉

全身高精度骨骼运动轨迹

双手末端精细操作细节

 

这三类数据,正对应人形机器人的两大算法体系:

小脑 —— 全身运动控制 (Whole-Body Control):行走、转身、蹲起、肢体协调,骨骼轨迹数据直接驱动运动控制策略训练; 

大脑 —— 全身操作规划 (Loco-Manipulation):移动中抓取、搬运、工具使用,全景视觉 + 末端细节数据支撑操作策略学习。

 

更重要的是 —— 这一切都不依赖任何机器人本体。

 

采集端与本体彻底解耦,意味着数据生产不再受本体数量、部署成本的限制;而采集到的人类动作数据,可跨构型适配 Unitree G1/H2、智元灵犀 X2、乐聚 KUAVO 5、星海图 KENGO 等各类人形机器人本体的算法训练。

 

图片

 

04

不止于发布:联合信通院

落地工业数据集 2.0

 

Delta D1不是一台停留在发布会上的设备。 

 

德塔智能已联合中国信息通信研究院 (信通院) 共同发布工业数据集 2.0,走出一条 “实景炼数” 的新路径:工人无需中断生产、无需搭建仿真环境,佩戴 D1即可在真实产线上边作业、边采集,生产数据与作业过程同步发生。

 

图片

 

目前,D1已在多个工业场景中规模化落地应用,持续产出高度贴合真实作业逻辑的工业具身数据。相比传统 “实验室造数”,这些从真实产线上生长出来的数据,在模型训练、算法验证与设备测试中展现出更高的适配性与实用价值,正在帮助工业具身智能机器人更快地走进复杂的真实工厂。

 

图片

 

从家庭到工厂,从日常起居到工业工位 ——D1 采集的每一小时数据,都在为人形智能的落地铺路。

 

 

05

为人形智能而生

 

具身智能的进步,需要模型、本体与数据三者协同驱动。模型日新月异,本体百花齐放,唯独高质量数据,始终是那块最短的板。

 

德塔智能选择从 “数据的源头” 做起:让数据采集回归人类作业本身,让每一个自然的动作都成为机器人可以学习的养分。

 

Delta D1的发布只是开始。德塔智能将持续迭代软硬一体的数采方案,与科研机构、行业伙伴共建高质量具身数据基础设施,加速通用人形机器人的技术迭代与产业化落地。

 

源自:Delta Intelligence 德塔智能

-END-

 

2025年,人形机器人产业迎来爆发拐点。特斯拉Optimus量产在即,华为、宇树等企业加速技术突破,行业正从“实验室研发”向“规模化落地”跃迁为打通产业链上下游协作壁垒,艾邦机器人正式组建"人形机器人全产业链交流群",覆盖金属材料、复合材料、传感器、电机、减速器等全硬件环节,助力企业精准对接资源、共享前沿技术!

扫码关注公众号,底部菜单申请进群

作者 ab, 808