具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

CF-JEPA:通过可控性因子分解提高JEPA世界模型的鲁棒性

CF-JEPA: Improving Robustness of JEPA World Models via Controllability Factorization

仅仿真代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

9 页 PDF · 0.6 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

§III,PDF页2–5 · §IV-A–C及表II–IV,PDF页4–6 · §IV-D–E与表V–VI,PDF页6–7 · §V,PDF页7

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

ViT-Tiny输出192维潜变量,拆为128维可控与64维不可控。两支分别用动作条件/无动作动力学预测,加入可控支逆动力学、不可控支梯度反转动作预测和SIGReg防坍塌;CEM仅最小化可控潜状态到目标图的距离。

实验设置与硬件

四基础任务为Reacher、PushT、OGBench Cube和TwoRoom,加入不遮挡主体的边缘移动彩色矩形。再以25万帧训练关节位置控制的简化ManiSkill Reach,16干扰物下测不同精度阈值;模型通常3训练种子。

结果及统计口径

两干扰物Reacher成功0.48,对LeWM0.07、SMWM0.10;64干扰物PushT为0.57对SMWM0.27。ManiSkill两厘米阈值0.35对0.22。但无干扰Reacher/PushT仅0.61/0.78,落后LeWM0.86/0.96。

局限与风险

所有验证为仿真及单类人工干扰。假设不可控状态不影响可控动力学,不适合遮挡或人与机器人交互。干净任务并非普遍持平;名义基线部分直接引自原文,不能视为全条件统一重跑。

复现建议

复现需相同离线轨迹、干扰生成和损失权重,区分训练时就加干扰与测试突发变化。CEM为300候选、30轮、5步规划。必须核验控制是否真正依赖当前视觉,OGBench末端IK接口可在遮挡下保持表现。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仅仿真
机器人型号
Reacher(仿真)、OGBench机械臂(仿真)、ManiSkill机械臂(仿真)

型号和使用场景以原文及上列说明为准;训练或离线采集平台不等于所提方法的实机闭环验证。

代码与训练

代码待核实 · 代码状态未核实

复现需相同离线轨迹、干扰生成和损失权重,区分训练时就加干扰与测试突发变化。CEM为300候选、30轮、5步规划。必须核验控制是否真正依赖当前视觉,OGBench末端IK接口可在遮挡下保持表现。 论文许可不代表代码许可,代码实际发布状态仍未知。

来源与分类证据

  • 表II–III,PDF页4–5:无干扰明显落后部分基线,有干扰条件改善;名义基线引用源论文。

    查看一手来源
  • §IV-C–D,PDF页6:OGBench当前视觉可被动作接口绕开,因此新增关节控制ManiSkill测试。

    查看一手来源
  • §V,PDF页7:单干扰族、仅仿真及可控/不可控独立假设。

    查看一手来源
  • PDF页6(已渲染目视核对):核对该页关键图表的行列对应、实验类别与数值;分析范围仅限sectionsRead所列章节,并非逐页翻译。

    查看一手来源