原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
22 页 PDF · 6.4 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文原文依据范围
§2 · §3.1–3.6 · §5 · PDF p9 Figure 7 and Table 5
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
以带语义、局部几何描述的SE(3)位姿轨迹为共同表示,将机器人连杆、物体、人体和动作目标放入同一令牌网格。逐令牌独立噪声的流匹配及非连续上下文令牌,允许通过更换已知/未知掩模执行未来预测、策略、补帧和重定向。
实验设置与硬件
按基准分别训练检查点,覆盖Language Table五类推物、TraceGen、OMOMO、人形重定向和更多定性规划。推物每类50回合、200步;G1轨迹送入TWIST在物理仿真中跟踪,测试30Hz完整输入、3Hz关键帧和噪声输入。
结果及统计口径
作者报告推物宏平均87.2%;MPC使两种绝对目标任务由90%/76%提高到100%/80%。G1干净输入仿真序列成功率86.90%,重定向吞吐86.97帧/秒。TraceGen误差降低,但400轨迹预测耗时4.18秒,高于对照2.66秒。
局限与风险
统一的是表示与推断形式,尚非跨全部基准联合训练的一个模型;依赖几何/深度和状态估计,未见形态不能直接泛化。真实视频是动作输入,图7明确显示后续为仿真运行,不能作G1实机部署证据。
复现建议
需固定每基准数据划分、坐标与旋转尺度、掩模及低层跟踪器;区分模型生成误差和物理跟踪成功率。本次已视觉核对PDF图7、表5及仿真标注,未运行代码。
实验标签与机器人
- 验证范围
- 仅仿真
- 机器人型号
- Unitree G1(仿真)、Panda(仿真)、UR3(仿真)、UR5(仿真)、UR10(仿真)、WidowX(仿真)、Kinova(仿真,型号未细分)、iiwa14(仿真)、iiwa7(仿真)
相关机器人档案
代码与训练
代码待核实 · 训练代码待核实
仅核对摘要;官方实现、许可证与训练入口尚待核实。
