具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

持续模仿学习是否仍然具有语言依据?面向机器人任务保持的语言扰动基准

Does Continual Imitation Learning Remain Grounded? A Language-Perturbed Benchmark for Robotic Task Retention

仅仿真代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

9 页 PDF · 1.7 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

第III节协议与指标,PDF第2–4页 · 第IV–V节实验和表I–II,PDF第4–6页 · 第VI节诊断分析,PDF第7页 · 第VII节局限,PDF第7–8页

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

从任务定义抽取动作、对象、关系、目标、属性五类语义槽,生成同义改写、单槽有效对比与场景冲突请求,随后校验实体和目标谓词。每学习一项任务后冻结评估,结合成功AUC、改写差距、目标切换与旧目标持续率。

实验设置与硬件

八种方法共用CLIP编码器、六层Transformer和混合高斯动作头,LIBERO-Goal十任务依次训练,每任务10轮、三个种子。每指令20个初始状态;改写覆盖各阶段,最小对比和冲突只测最终检查点。

结果及统计口径

按表I,DMPEL原始/改写AUC为78.33/70.28,最终成功率81.12%,却仍有8.05点改写差距。其有效新目标成功率30.91%,排除旧目标后切换率仅21.68%;不相容指令下多数方法仍启动动作。

局限与风险

只测共同行为克隆架构,不能直接外推大VLA;最终阶段诊断无法分离原有缺陷与持续学习影响。正文对部分AUC及差距的叙述与表I不一致,故保留表格数值并标注待澄清。

复现建议

复现需保存已验证指令清单、各方法任务ID/路由使用、配对初始状态及成功谓词。不可把无法执行的请求当作普通失败任务,也应同时报告绝对能力与改写差距,避免低能力模型因差距小被误判鲁棒。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仅仿真
机器人型号
LIBERO-Goal机械臂(MuJoCo仿真)

型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。

代码与训练

代码待核实 · 代码状态未核实

复现需保存已验证指令清单、各方法任务ID/路由使用、配对初始状态及成功谓词。不可把无法执行的请求当作普通失败任务,也应同时报告绝对能力与改写差距,避免低能力模型因差距小被误判鲁棒。 论文许可不代表代码许可,代码实际发布状态仍未知。

来源与分类证据

  • PDF第5页表I(已渲染核看):DMPEL表中78.33/70.28/8.05,正文却写78.51/71.24/7.27,原文存在内部数字冲突。

    查看一手来源
  • PDF第5页表II:GSA要求达到新目标且不满足原目标,区别于一般target success。

    查看一手来源
  • PDF第8页局限:明确未评测large-scale VLAs;协议四套覆盖不等于四套政策实验。

    查看一手来源