具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
经典研究

通过域随机化将深度网络从仿真迁移到现实

Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World

仿真 + 实物代码待核实原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

8 页 PDF · 3.9 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

III 域随机化、VGG式位置回归 · IV-A/B 数据与表I定位 · IV-C 图4/5和表II消融 · IV-D Fetch抓取及V局限

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

论文随机化合成场景纹理、灯光、物体位置、干扰物、相机姿态与视场,训练VGG式卷积网络从单幅RGB回归目标中心坐标。已知目标形状尺寸、固定桌高降低了几何难度;无需逼真纹理或真实图像微调,模型学到的是位置估计,不是完整抓取控制。

实验设置与硬件

八个几何物体各有60张真实测试图,分独物体、干扰和遮挡三组,共480张;相机距离约70至105厘米。比较合成图数量、纹理数量、ImageNet初始化、噪声与相机/干扰物随机化;最后将定位器接常规运动规划和预设抓取,在Fetch上测试。

结果及统计口径

作者报告真实平均定位误差约1.5厘米,仿真为0.3至0.5厘米。两种较稳定目标在40次杂乱抓取中成功38次,另对Spam罐10次成功9次。表II固定两万训练图时,去干扰物随机化使干扰测试误差由1.8厘米增至7.2厘米;加普通图像噪声作用较小。

局限与风险

低样本、高度固定、简单几何以及选择表现较好的两种检测器限制了外推;相机只在近似指定范围随机变化,不能理解为任意视角免校准。真实定位误差仍大于仿真,尚未验证高精度接触操作或动力学策略迁移。

复现建议

复现需物体网格、MuJoCo渲染、随机化范围及真实网格测位协议,单独核对抓取规划器。应固定最佳模型选择方式并逐类别报告误差和40/10次试验;区分视觉合成训练与整个机器人系统是否经过标定或人工设计。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仿真 + 实物
机器人型号
Fetch

代码与训练

代码待核实 · 本次未核实原论文官方代码。

合成图像监督训练定位器;真实抓取用于验证。

来源与分类证据

  • 首发日期、仿真RGB训练与真实定位摘要。

    查看一手来源
  • 真实抓取部分明确Fetch机器人和完整流水线。

    查看一手来源
  • III-A/B:Fixed table height;camera random within10×5×10cm box,angles±0.1rad,FOV±5%;VGG16-style position regression.

    查看一手来源
  • IV-B 表I:480 real images;8objects×3conditions×20images;~1.5cm mean real localization.

    查看一手来源
  • IV-C 表II:20k training samples;distractor error1.8→7.2cm without distractors.

    查看一手来源
  • IV-D:Fetch;prescribed grasp+off-the-shelf motion planner;38/40 selected geometric-object trials;9/10Spam.

    查看一手来源