原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
6 页 PDF · 3.6 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文原文依据范围
3 Method · 4 Experiments · Figure 2 · Table 1 · 5 Limitations
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
CAG研究世界动作模型生成看似合理却不完成关键阶段的问题,如一直持物而不释放。它不重新训练,而汇总视频/动作查询对语言词元的跨注意力,稀疏选中当前重要词元,按有界系数放大其键和值,让短时采样更容易出现完成转移。理想完成奖励仅用于动机推导,采样并没有可用的真实完成指示器。
实验设置与硬件
对DreamZero的三个官方DROID仿真场景各做50次,对Fast-WAM在RoboTwin2.0中原报告低于90%的九任务各做30次;两骨干所有任务统一引导强度0.15,仅改变推理引导。另比较1.6秒短片与五秒生成范围。
结果及统计口径
作者报告九任务平均64.4%升至70.0%,DreamZero三任务平均约69%升至75%;失败案例中被归因为未完成想象的比例79%降至40%。该比例的分母是失败案例,不是全部回合,不能解读为总失败率下降39点。
局限与风险
所选RoboTwin子集刻意排除已饱和任务,不能推为全基准结果;开微波炉及放罐入篮任务反而下降。样本量小、未报告实机验证;注意力亲和度是启发式替代而非已证明的完成敏感度。
复现建议
复现需锁定原模型权重、官方仿真场景、采样层及词元门控实现,保留固定引导强度和逐任务随机种子;还应记录失败归因规则和逐任务成功计数。本分析未运行模型。
实验标签与机器人
- 验证范围
- 仅仿真
- 机器人型号
- 未核实
代码与训练
代码待核实 · 训练代码待核实
仅核对摘要;官方实现、许可证与训练入口尚待核实。
