人形机器人基础模型公司德塔智能(Delta Intelligence)近日宣布完成近5亿元天使++轮融资,这是公司自2026年1月成立以来半年内完成的第六轮融资。本轮投资方涵盖多家上市公司产业方和头部财务投资机构,资金将用于人形机器人基础模型持续迭代、自研数采设备量产与数据闭环建设,以及核心研发团队扩充,推动技术在真实工业场景中的工程化落地与验证。

德塔智能此前已获得多轮融资,投资方包括北京通研院、智元机器人、乐聚机器人、星海图等人形机器人主机厂,高瓴创投、元禾控股、复星锐正、华映资本、联想创投等财务机构,以及汽车、半导体领域资本。密集的资本注入反映出市场对原生通用人形机器人基础模型HFMs(Humanoid Foundation Models)前景的看好。

公司三位核心创始人均拥有UCLA博士学位,具备清华本科、北大任教等学术背景,技术专长覆盖机器人学习、大规模机器学习、机器人系统与具身智能。他们的研究及产业经历横跨Google Robotics、NVIDIA Research、DeepMind、Meta、北京大学和北京通用人工智能研究院,并参与过多项美国DARPA、ONR及NSF机器人项目。这种多元背景使团队形成了从前沿研究到技术落地的全栈软硬件能力。

德塔智能的技术路径强调“全身智能”必须从底层原生构建,而非在既有框架上迁移复制。创始人兼CEO马晓健指出,人形机器人走出实验室后,面对的是带有台阶、门槛、楼梯等复杂地形的真实物理空间,需要同时移动、操作并在动态环境中保持平衡与决策。当前主流具身智能模型的空间认知仍建立在二维视觉表征之上,容易缺失真实空间深度、产生几何关系歧义,在大场景中上下文易爆炸,制约了机器人的环境理解与安全作业能力。

为解决这一结构性偏差,德塔智能构建了一套原生三维世界引擎,以三维表征作为模型核心,可直接处理点云、高斯泼贱等三维场景表示,实现原生的三维理解、推理和对未来环境状态的推演。引擎的运转需要持续的数据供给,公司自研了一套全身全景数采设备,采用纯视觉采集架构,同步捕捉手、脚、腰、肩全维度人体骨架关节运动轨迹,基于第一视角视频流实时增量重建全局三维场景。单次采集可输出完整人体全身骨架数据和高精度三维场景数据两类核心训练素材。

在采集路径上,德塔智能规划了分层方案,包含搭载机器人本体的遥操作采集以及无需实体机器人的UMI、Ego-centric无本体动捕模式。无本体采集效率更高、硬件成本更低,适用于大规模积累通用全身交互样本;遥操作采集则用于后期的真机微调与精度对齐。马晓健强调,市面上多数数采方案仅能采集手部等局部动作,基于此训练的模型难以完整理解人与环境的交互,也难以掌握攀爬梯具、推拉重型门等依赖全身协同的复杂任务。

德塔智能搭建了“大脑+小脑+力位混合”三层原生协同架构。大脑模块搭载自研三维世界引擎,负责环境感知、长时序任务规划、高层交互意图输出;小脑是基于海量仿真强化学习训练的神经网络,接收大脑稀疏高层指令,转化为数十至数百赫兹的全身电机精细控制信号,实时动态调整重心、协调四肢发力;最后经由力位混合层输出柔顺的控制。这种大小脑分层架构在全尺寸人形、五指灵巧手等高自由度设备上能充分释放价值。

马晓健判断,随着具身智能产业化加速,算法模型企业与硬件主机厂深度协同将成为主流发展模式。德塔智能已与智元、乐聚、星海图、宇树等头部人形机器人厂商建立长期合作,依托标准化的本体适配流程,实现模型在不同硬件平台间的快速迁移。公司定位为人形机器人生态中的基础模型提供方,致力于为各类本体提供可部署、可扩展的全身智能底座,成为连接硬件平台与上层应用的关键一环。