具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

面向世界动作模型的任务完成感知引导

Completion Aware Guidance for World Action Models

仅仿真代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

6 页 PDF · 3.6 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

3 Method · 4 Experiments · Figure 2 · Table 1 · 5 Limitations

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

CAG研究世界动作模型生成看似合理却不完成关键阶段的问题,如一直持物而不释放。它不重新训练,而汇总视频/动作查询对语言词元的跨注意力,稀疏选中当前重要词元,按有界系数放大其键和值,让短时采样更容易出现完成转移。理想完成奖励仅用于动机推导,采样并没有可用的真实完成指示器。

实验设置与硬件

对DreamZero的三个官方DROID仿真场景各做50次,对Fast-WAM在RoboTwin2.0中原报告低于90%的九任务各做30次;两骨干所有任务统一引导强度0.15,仅改变推理引导。另比较1.6秒短片与五秒生成范围。

结果及统计口径

作者报告九任务平均64.4%升至70.0%,DreamZero三任务平均约69%升至75%;失败案例中被归因为未完成想象的比例79%降至40%。该比例的分母是失败案例,不是全部回合,不能解读为总失败率下降39点。

局限与风险

所选RoboTwin子集刻意排除已饱和任务,不能推为全基准结果;开微波炉及放罐入篮任务反而下降。样本量小、未报告实机验证;注意力亲和度是启发式替代而非已证明的完成敏感度。

复现建议

复现需锁定原模型权重、官方仿真场景、采样层及词元门控实现,保留固定引导强度和逐任务随机种子;还应记录失败归因规则和逐任务成功计数。本分析未运行模型。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仅仿真
机器人型号
未核实

代码与训练

代码待核实 · 训练代码待核实

仅核对摘要;官方实现、许可证与训练入口尚待核实。

来源与分类证据