原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
原文依据范围
第III节协议与指标,PDF第2–4页 · 第IV–V节实验和表I–II,PDF第4–6页 · 第VI节诊断分析,PDF第7页 · 第VII节局限,PDF第7–8页
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
从任务定义抽取动作、对象、关系、目标、属性五类语义槽,生成同义改写、单槽有效对比与场景冲突请求,随后校验实体和目标谓词。每学习一项任务后冻结评估,结合成功AUC、改写差距、目标切换与旧目标持续率。
实验设置与硬件
八种方法共用CLIP编码器、六层Transformer和混合高斯动作头,LIBERO-Goal十任务依次训练,每任务10轮、三个种子。每指令20个初始状态;改写覆盖各阶段,最小对比和冲突只测最终检查点。
结果及统计口径
按表I,DMPEL原始/改写AUC为78.33/70.28,最终成功率81.12%,却仍有8.05点改写差距。其有效新目标成功率30.91%,排除旧目标后切换率仅21.68%;不相容指令下多数方法仍启动动作。
局限与风险
只测共同行为克隆架构,不能直接外推大VLA;最终阶段诊断无法分离原有缺陷与持续学习影响。正文对部分AUC及差距的叙述与表I不一致,故保留表格数值并标注待澄清。
复现建议
复现需保存已验证指令清单、各方法任务ID/路由使用、配对初始状态及成功谓词。不可把无法执行的请求当作普通失败任务,也应同时报告绝对能力与改写差距,避免低能力模型因差距小被误判鲁棒。
实验标签与机器人
- 验证范围
- 仅仿真
- 机器人型号
- LIBERO-Goal机械臂(MuJoCo仿真)
型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。
代码与训练
代码待核实 · 代码状态未核实
复现需保存已验证指令清单、各方法任务ID/路由使用、配对初始状态及成功谓词。不可把无法执行的请求当作普通失败任务,也应同时报告绝对能力与改写差距,避免低能力模型因差距小被误判鲁棒。 论文许可不代表代码许可,代码实际发布状态仍未知。
