具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

Opt2VLA:面向接触密集型人形机器人全身操作的力感知视觉—语言—动作框架

Opt2VLA: Force-Aware Vision-Language-Action for Contact-Rich Humanoid Whole-Body Manipulation

仿真 + 实物代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

18 页 PDF · 16.2 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

III-A–C · IV-A–D · V · Tables I–III; Figs 6–7

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

Opt2VLA把接触力目标显式加入GR00T-N1.7输出,与手脚运动目标一起交给任务专用全身RL控制器。轨迹优化生成满足动力学的动作、接触力及关节力矩参考,力矩参考仅训练时提供;实测力矩历史经独立编码器输入VLA,另预测未来力矩作辅助监督。

实验设置与硬件

Agility Robotics Digit,48千克、30自由度20主动关节,做擦桌、推盒入架、双手提盒。九个VLA配置每个90个仿真回合;硬件低层每任务30次,端到端按三任务×三力提示×五次共45次。

结果及统计口径

默认配置仿真联合成功82.2%,运动状态基线40.0%;联合标准同时要求任务完成、语言力区间及命令—实测均值误差。实机低层力MAE擦桌7.0N、推盒3.9N、提盒1.7N,端到端显示轻/中/强力指令可调制实际作用力。

局限与风险

82.2%不是45次实机成功率;实机擦桌虽相关性高仍有7N偏差。提示对应固定训练力区间且场景外观来自训练家族,泛化有限;三个底层控制器各自专用,尚非任意接触任务通用控制。

复现建议

需分别保存轨迹优化约束、控制器奖励、关节实测力矩标定和提示力区间;复现独立力矩token与简单拼接的消融。评估同时统计任务门槛、指令力匹配、真实力误差,防止只报告几何完成。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仿真 + 实物
机器人型号
Agility Robotics Digit

论文 §IV-A 明确平台为 Digit,不能替换成 Unitree G1。

代码与训练

代码待核实 · 未核实公开训练代码

项目页有 Code 文本链接,但本次点击仍回到项目页,未核实独立公开代码仓库。

来源与分类证据