原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
18 页 PDF · 4.5 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文原文依据范围
PDF第6页选段(提取文本L440–457) · PDF第7页选段(提取文本L513–530) · PDF第8页选段(提取文本L610–623) · PDF第3页选段(提取文本L185–220) · PDF第9–10页选段(提取文本L707–741) · PDF第4页选段(提取文本L255–280)
原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
GPT-3从指令提取地标,CLIP将地标关联到先前探索的图像节点,视觉导航模型估计节点连通并执行图搜索所得路线;三个模型权重均冻结。
实验设置与硬件
真实Jackal在户外遵循自然语言路线,先人工驾驶构图;LLM/VLM查询在远程工作站预计算,低层视觉导航机载运行。
结果及统计口径
展示达到约800米目标的导航和地标歧义消解;规划成功和实际路线效率分别定义,不应把离线路径选择算成端到端自主探索。
局限与风险
主要理解地标,忽略慢速行驶等动词和细节要求;低层模型针对Jackal户外导航,依赖预先探索地图。
复现建议
保留构图数据、语言提示、CLIP型号和缓存查询,并区分人工建图、远程规划与机载执行各部分。
实验标签与机器人
- 验证范围
- 实物实验
- 机器人型号
- Clearpath Jackal
代码与训练
有开源代码 · 官方实现已核验
没有完整机器人策略训练;提供图规划与语言消融 notebook。 提供样例图和实验获取入口,不是完整机器人导航数据全集。 依赖预训练外部模型和缓存响应,未发布整套低层导航权重。 这份发布主要是图规划和语言模块,不是完整 Jackal 底层控制与视觉导航模型训练栈。 本次未运行训练、复现实验或实机控制。
