原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
原文依据范围
第3–4节问题与CRAFT,PDF第3–6页 · 第5节实验、表1–3与消融,PDF第6–9页 · 第6节讨论局限,PDF第9页
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
增加技能与状态查询词元,前者读取图文,后者只读图像。以动作流匹配误差对比同技能/异技能表示,再将反事实技能表示与参考演示状态配对,监督参考动作速度场;分开路由梯度,避免直接拿异场景动作作标签。
实验设置与硬件
仿真Pick-Place含16组合仅示范4种,Pick-Place-Press含8组合仅示范2种,分别测π0、π0.5、GR00T N1.7。每组合50初始状态、三个评测种子;Piper真机每已见组合20演示,每组合测试5次。
结果及统计口径
π0.5在两基准未见组合成功率84.2%和62.6%,普通全微调为8.4%和0.7%。真机未见组合43/60,对照9/60;已见组合双方均19/20。仅技能对比不足,改变当前技能与保留当前技能的两类反事实监督共同贡献最大。
局限与风险
要求所有组成技能已有演示,操作顺序固定;不能泛化成任意新技能规划。仿真误差条来自同一训练检查点的评测种子,未覆盖训练方差;真机每组合仅五次且场景较简单。
复现建议
需复现VLM轨迹分段标签、反事实只改当前/未来操作的规则、三种损失及停止梯度位置,并严格分离示范与未示范组合。代码和新基准发布承诺已见于论文,本次未独立核验下载状态。
实验标签与机器人
- 验证范围
- 仿真 + 实物
- 机器人型号
- Piper 6-DoF(真机)、Pick-Place/Press仿真机械臂
型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。
相关机器人档案
代码与训练
代码待核实 · 代码状态未核实
需复现VLM轨迹分段标签、反事实只改当前/未来操作的规则、三种损失及停止梯度位置,并严格分离示范与未示范组合。代码和新基准发布承诺已见于论文,本次未独立核验下载状态。 论文许可不代表代码许可,代码实际发布状态仍未知。
