具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

利用补充肌电与视觉任务描述对视觉语言动作模型进行连续条件控制

Continuous Conditioning of VLAs with Augmenting EMG and Visual Task Descriptors

仿真 + 实物代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

7 页 PDF · 1.7 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

III Methods · IV Results · V Conclusion · Appendix VI-A–E · Tables I–IV

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

研究把任务描述持续注入语言以外的输入。EC-VLA在SmolVLA本体状态后拼接八通道肌电包络,用腕屈伸及放松指导左右修正和选择;VA-VLA在π0.5图像上用颜色分割掩码标出目标及放置点,两者文字仅给通用操作指令。

实验设置与硬件

实机SO-101由三位参与者各提供105段示范并分别训练;每模型测20次无杂物和十次杂物试验。视觉提示实验使用RoboCasa移动底盘Franka Panda仿真,16项任务约1600段示范,每任务50次,另选八任务加入干扰物。

结果及统计口径

作者报告实机普通条件两者成功率均80%,杂物条件从30%升到50%;仿真全部任务均值由26.6%到31.4%,杂物八任务由11.3%到19.8%。完成分数包含部分进度,不能与完整成功率混用。

局限与风险

肌电部署仍需要对应用户持续指导,未检验陌生用户;仿真掩码来自模拟器,真实分割误差未纳入。模态变化同时改变了反馈更新频率,不能将增益全部归因于非语言形式;逐任务成功率并非全都提高。

复现建议

附录给出肌电整流及2Hz低通、SmolVLA冻结骨干训练40K步,以及π0.5全参70K步、双H200训练。复现应保留参与者划分、持续人类输入和精确部分评分,另验证真实视觉跟踪器。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仿真 + 实物
机器人型号
SO-101、Franka Panda(RoboCasa仿真,移动底盘)

相关机器人档案

代码与训练

代码待核实 · 训练代码待核实

仅核对摘要;官方实现、许可证与训练入口尚待核实。

来源与分类证据

  • 依据原文摘要;实验范围与型号待全文复核

    查看一手来源
  • III-A; VI-B:三人各105演示;实机SO-101,8通道Myo EMG。

    查看一手来源
  • III-B:视觉掩码实验为RoboCasa仿真,不是真机Franka结果。

    查看一手来源
  • Tables II–IV:成功率与部分完成分数不同;杂物任务Counter-to-Sink成功率0.18降至0.16。

    查看一手来源