原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
原文依据范围
§3 · §4.1–4.3 · Tables 1–3 · Appendix A
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
先重定向并筛选人体动作,以全状态特权信息训练全身模仿教师,再用DAgger蒸馏成只依赖头/双手三点目标和25步本体历史的学生。学生无需显式全局线速度估计;灵巧手由VR姿态经逆运动学控制,另以视觉模仿策略输出运动目标。
实验设置与硬件
仿真在约1.4万条重定向增强动作上比较教师、H2O及历史/关键点消融;真实Unitree H1加Inspire手评测20条站立动作,并演示VR、相机、语言接口。收集约40分钟六任务示范,四任务各十次评测自主模仿。
结果及统计口径
作者报告仿真学生追踪成功94.10%,教师94.77%、H2O87.52%;真实全局关节位置误差47.94毫米,对照87.33毫米。四个自主任务扩散策略平均约8/10,普通BC约1/10;这些是所选任务平均,不代表所有遥操作技能自主化。
局限与风险
大规模动作覆盖来自仿真,真实量化主要为站立序列;三点输入可能对应多个全身姿态。灵巧手直接映射和全身策略是不同模块,GPT-4o演示选运动原语不等于通用视觉闭环操作。
复现建议
应记录人体到H1重定向、稳定站立增强、奖励课程和域随机化,并分别校验50Hz策略与200HzPD接口。比较时对齐全局/相对误差和成功阈值;未实机复现。
实验标签与机器人
- 验证范围
- 仿真 + 实物
- 机器人型号
- Unitree H1、Inspire手
论文只给出Inspire手品牌,未给精确手部子型号;不借用HumanPlus的RH56DFX型号。
相关机器人档案
代码与训练
有开源代码 · 官方教师训练、学生蒸馏与动作资源公开;许可限制非商业用途。
通过RL训练特权教师,再进行基于历史的DAgger式学生蒸馏;与H2O共用代码库并有独立配置。
