具身智能速查
60 分钟更新
具身智能速查阅读原文 · 追踪方法 · 连接实践
近期研究

GR00T N1:面向通用人形机器人的开放基础模型

GR00T N1: An Open Foundation Model for Generalist Humanoid Robots

仿真 + 实物有开源代码原文关键章节已核对

原文关键章节已核对

以下分析来自论文原文,保留实验条件与结果适用范围。

36 页 PDF · 20.0 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文
原文依据范围

§2–3 · §4.1–4.5 · Tables 2–3 · Appendix B, E

原文来源与版本用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。

基于原文的中文分析

方法机制

GR00T N1将Eagle-2视觉语言模块与流匹配Diffusion Transformer相连,以本体专用编码/解码适配不同状态动作维度。混合真实遥操作、物理仿真、人类视频和生成视频,借潜在动作或逆动力学伪标签利用无动作视频,再进行任务后训练。

实验设置与硬件

仿真覆盖RoboCasa24、DexMimicGen9及GR-1桌面24任务,每任务30/100/300示范;真实Fourier GR-1涵盖抓放、关节物体、工业和协作任务。多数实机任务10次,Pack Machinery五次并按物体完成数计分,使用阶段性部分得分。

结果及统计口径

作者表3全数据平均76.8%,Diffusion Policy46.4%;仅10%数据为42.6%,基线10.2%。仿真100示范设置平均45.0%,基线33.4%;这是后训练收益,不能当所有新任务零样本成功率。

局限与风险

实机主要桌面操作,不证明行走或开放世界通用性。部分成功计分使百分比并非严格完整回合成功;仿真选择末五检查点最高分。预训练规模、数据混合与模型容量共同变化,不能全归于单一架构。

复现建议

复现应区分预训练两任务测试、后训练及视频增强分支,保留任务权重、部分计分、checkpoint选择和本体接口。论文提供模型/数据/基准入口,但发布资产不等于本轮已验证完整大规模预训练可复现。

这是原文分析,不是逐字全文译本,也不代表本站已复现实验。

实验标签与机器人

验证范围
仿真 + 实物
机器人型号
Fourier GR-1

代码与训练

有开源代码 · 官方代码与 GR00T-N1-2B 权重公开;主仓库已演进到后续版本。

代码与模型权重许可分开,权重按 NVIDIA 模型条款;复现须固定 N1 对应版本,不能把新主分支当原论文实现。

来源与分类证据