具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

运动学MeanFlow:用于机器人基础模型的单步动作生成策略

Kinematic MeanFlow: One-Step Action Generation Policy for Robotic Foundation Models

仅仿真代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

18 页 PDF · 21.7 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

§3,PDF页4–6 · §4.1–4.2及表1–2,PDF页6–7 · §4.3–4.5及表3–5,PDF页8–9 · §5限制,PDF页9

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

依据区间平均速度恒等式,将MeanFlow目标中的总时间导数拆成早期、晚期两部分,缓解末期局部加速度突增和样本间尺度扩张。用前向自动微分JVP并行计算两项,比较随机、中点和小MLP学习分割点;推理一次网络评估直接输出动作块。

实验设置与硬件

GR00T-N1.6微调及SimVLA-S从头训练,在LIBERO、COMPASS PointNav及SimplerEnv评估。Fractal/BridgeData V2虽来自实机,本文属于Real2Sim;导航Unitree G1也在仿真。另在L40和Jetson Orin测eager/compile延迟。

结果及统计口径

LIBERO平均成功率:GR00T单步97.9%对四步97.3%,SimVLA单步95.1%对十步94.2%。Fractal、Bridge评测为78.4%/59.9%。动作头延迟降低67.5–74.4%,端到端降低30.3–54.9%。

局限与风险

未提供实机闭环验证,未覆盖全身控制或灵巧操作;训练时间较流匹配增加约27–33%。性能并非逐任务全部提升,例如Bridge胡萝卜和Fractal关门略降;硬件延迟收益依赖主干占比及编译设置。

复现建议

复现须加入第二时间嵌入、正确stop-gradient与JVP切向量,区分训练迭代数和NFE。原文提供超参与算法,基线MeanFlow需更精细训练;应同时报告等迭代训练成本、动作头与整模型延迟,代码实际开放状态未核验。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仅仿真
机器人型号
GoogleX(SimplerEnv仿真)、WidowX(SimplerEnv仿真)、Unitree G1(COMPASS仿真)

型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。

代码与训练

代码待核实 · 代码状态未核实

复现须加入第二时间嵌入、正确stop-gradient与JVP切向量,区分训练迭代数和NFE。原文提供超参与算法,基线MeanFlow需更精细训练;应同时报告等迭代训练成本、动作头与整模型延迟,代码实际开放状态未核验。 论文许可不代表代码许可,代码实际发布状态仍未知。

来源与分类证据

  • §4.1,PDF页6;表3,PDF页8:明确Sim2Sim与Real2Sim,不能将真实训练数据当实机实验。

    查看一手来源
  • 表2,PDF页7;表5,PDF页9:成功率与L40/Orin延迟来自不同实验设置。

    查看一手来源
  • PDF页9(已渲染目视核对):核对该页关键图表的行列对应、实验类别与数值;分析范围仅限sectionsRead所列章节,并非逐页翻译。

    查看一手来源