原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
原文依据范围
§3,PDF页4–6 · §4.1–4.2及表1–2,PDF页6–7 · §4.3–4.5及表3–5,PDF页8–9 · §5限制,PDF页9
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
依据区间平均速度恒等式,将MeanFlow目标中的总时间导数拆成早期、晚期两部分,缓解末期局部加速度突增和样本间尺度扩张。用前向自动微分JVP并行计算两项,比较随机、中点和小MLP学习分割点;推理一次网络评估直接输出动作块。
实验设置与硬件
GR00T-N1.6微调及SimVLA-S从头训练,在LIBERO、COMPASS PointNav及SimplerEnv评估。Fractal/BridgeData V2虽来自实机,本文属于Real2Sim;导航Unitree G1也在仿真。另在L40和Jetson Orin测eager/compile延迟。
结果及统计口径
LIBERO平均成功率:GR00T单步97.9%对四步97.3%,SimVLA单步95.1%对十步94.2%。Fractal、Bridge评测为78.4%/59.9%。动作头延迟降低67.5–74.4%,端到端降低30.3–54.9%。
局限与风险
未提供实机闭环验证,未覆盖全身控制或灵巧操作;训练时间较流匹配增加约27–33%。性能并非逐任务全部提升,例如Bridge胡萝卜和Fractal关门略降;硬件延迟收益依赖主干占比及编译设置。
复现建议
复现须加入第二时间嵌入、正确stop-gradient与JVP切向量,区分训练迭代数和NFE。原文提供超参与算法,基线MeanFlow需更精细训练;应同时报告等迭代训练成本、动作头与整模型延迟,代码实际开放状态未核验。
实验标签与机器人
- 验证范围
- 仅仿真
- 机器人型号
- GoogleX(SimplerEnv仿真)、WidowX(SimplerEnv仿真)、Unitree G1(COMPASS仿真)
型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。
代码与训练
代码待核实 · 代码状态未核实
复现须加入第二时间嵌入、正确stop-gradient与JVP切向量,区分训练迭代数和NFE。原文提供超参与算法,基线MeanFlow需更精细训练;应同时报告等迭代训练成本、动作头与整模型延迟,代码实际开放状态未核验。 论文许可不代表代码许可,代码实际发布状态仍未知。
