超维动力发布全球最高自由度人形机器人“KAI”
4月26日,具身智能企业超维动力(Kinetix AI)在「降临GIFTED」发布会上,正式推出其首款全尺寸人形机器人“KAI”。此次发布形式别具一格,KAI并未以传统方式被介绍,而是通过两位KAI之间的“对谈”与“自我介绍”,呈现其能力、技术路径及产品定位。
联合创始人Tyler在发布会上指出,为了让机器人真正融入人类社会,其设计必须具备高度拟人性。他强调,人类的物理智能源于与现实世界的互动,因此机器人至少应在三个核心能力上形成闭环:感知世界、学习世界、与世界交互。对应的技术模块包括:物理世界模型、第一人称数据集和高拟人本体。
世界模型:为机器人提供环境感知与预测能力
所谓“理解世界”,指的是机器人不仅要感知当前环境,还需具备对未来变化的预测能力,这正是KAI World Model所实现的核心功能。
目前,超维动力已构建出闭环式世界模型系统,包括主体模型、动作模块与评估模块。其中,动作模块负责生成候选动作并反馈给主体模型,主体模型据此预测未来状态,评估模块则对轨迹进行价值判断,涵盖任务进度和安全性评估等。
第一人称数据集:还原真实人类经验
如果说世界模型帮助机器人理解世界,那么第一人称数据集则使KAI能够积累类似人类的经验。其核心理念是借助人类视角与动作来观察和接触世界。
超维动力自主研发的规模化数据采集终端KAI Halo,采用轻量化头环设计,具备“一芯八摄”配置,能一站式采集第一人称视角视频、人体姿态及场景点云数据。该设备轻便易用,佩戴者可在日常活动中自然佩戴,从而采集出更贴近现实场景的多模态数据。
相较于预设动作流程,这种数据采集方式能记录更多样化的自然行为,更适合人形机器人的深度学习。
三阶段训练体系:构建从感知到行动的完整能力链
世界模型赋予KAI理解世界的能力,第一人称数据集则为其积累经验,接下来的关键在于如何将经验转化为技能,这正是三阶段训练体系的设计目标。
- 预训练阶段:利用互联网与仿真数据,结合第一人称视角数据补充全身交互语义信息,构建“空间-语言-视觉-任务动作”对齐的常识。
- 桥接训练阶段:引入UMI及数采手套数据,补充手部动作与接触细节,弥补预训练中动作精细度的不足。
- 后训练阶段:通过真实场景中遥控操作数据,解决机器人本体动作与任务目标的对齐问题。
高拟人本体KaiBot:让机器人真正走进人类生活
在具备数据与决策能力后,KAI需要一个具备高度拟人化的执行体——KaiBot,使其能够自然融入人类日常,并安全地与人互动。
KaiBot的高拟人本体可从四个维度进行描述:体型拟人、体格拟人、体能拟人与感知拟人。
在体型方面,KaiBot身高173厘米,体重70公斤,头身比为1:8.5,整体体型与质量分布接近成年人类,确保稳定性的同时符合人体工程学。
在体格方面,KaiBot拥有115个自由度,肩部、颈部、腰部等部位的活动范围高度拟人。其单手配备36个自由度,包括22个主控自由度和14个柔顺自由度,可完成抓握、捏取等精细操作,同时具备缓冲能力,提升交互安全性。
在体能方面,KaiBot搭载1.7kWh半固态电池,支持约3小时的双臂操作任务。其定制柔顺执行器不仅提升运动自然度,还使双臂负载能力接近20kg,兼顾交互友好性与作业性能。
在感知方面,KAI配备全身触觉皮肤系统,覆盖18000个触点,可精准感知0.1N以上的触碰并作出反馈。这项技术使机器人在真实环境中具备更高质量的反馈闭环能力,适用于近距离协作与陪伴交互。
在发布会的最后,KAI表示:“我的存在并非为了在无人工厂搬运重物,也不只是为了在舞台上完成极限翻滚。我被创造出来的真正目的是走进您的客厅、办公室,去理解您的意图,回应您的触碰,并最终与您共同协作、共处。”