原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
8 页 PDF · 2.3 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文原文依据范围
PDF第4页选段(提取文本L381–398) · PDF第4页选段(提取文本L400–413) · PDF第4–5页选段(提取文本L418–431) · PDF第6页选段(提取文本L650–667) · PDF第3页选段(提取文本L240–270) · PDF第5页选段(提取文本L456–485) · PDF第3–4页选段(提取文本L280–315)
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
在ViNT式视觉编码中随机遮蔽目标token,用同一个动作扩散模型学习有目标导航与无目标探索,配合拓扑图进行长时序搜索。
实验设置与硬件
六种真实室内外环境,比较未知环境探索和已知环境图像目标导航;同时报告成功率与每次试验的碰撞数。
结果及统计口径
原文报告相比子目标图像扩散基线更高探索成功、参数量约少15倍;该对照是完整导航架构,不是任何扩散模型之间的通用结论。
局限与风险
目标主要以图像指定,高层仍使用标准前沿探索;语言或坐标目标以及语义驱动探索尚未在本工作完成。
复现建议
固定目标遮蔽概率、动作扩散采样和拓扑图策略,保持训练数据与任务初态一致,并同时评估碰撞和成功。
实验标签与机器人
- 验证范围
- 实物实验
- 机器人型号
- LoCoBot(Kobuki底盘)
代码与训练
有开源代码 · 官方实现已核验
训练、微调、ROS 数据处理及部署脚本已发布。 列出公开数据;部分原训练数据未发布,需联系作者。 作者提供 GNM/ViNT/NoMaD 检查点链接。 作者明确训练混合了公开和未公开数据,不能宣称从零完全复现全部原始数据;不同方法共仓不应重复计数。 本次未运行训练、复现实验或实机控制。
