原文关键章节已核对
以下分析来自论文原文,保留实验条件与结果适用范围。
9 页 PDF · 10.0 MB归档日期 2026-10-04已核对方法、实验、结果与局限
从官方来源获取原文本次核对范围
§III · §IV-A–D · Tables II–IV
归档用于研究核对。公开可获取不等于允许全文转载;本站提供中文分析和官方原文链接。
方法机制
基准将工具使用拆为选择拾取、固定站位操作、移动操作三级,以推球、钩球及击碎冰块三种功能配合有无诱饵工具构成18任务。记录首次接触、正确工具抬升、工具接触目标及最终成功,避免只凭最终分数混淆选择与执行。
实验设置与硬件
ToolBook含3003条仿真及91条真实演示。七种策略各训练一次,每个仿真任务100回合;三种策略经真实数据微调后,在G1与Dex3双手上测试推球、钩球四种L1条件,每项10次。实机未覆盖移动L2或碎冰全部任务。
结果及统计口径
作者报告FastWAM仿真标准推球由L1的76%降到L2的9%;GR00T N1.7真实标准推球6/10,FastWAM为5/10,ACT为1/10。诱饵通常降低强策略固定站位成绩,未见工具与无关指令探针揭示泛化和指令遵循问题。
局限与风险
真实样本小且场景范围有限,训练仅单次,不能据此给出稳定的全模型排名;不同策略采用各自动作块长度。L0、L1为不同任务,不能直接用两者成功率相减解释流程漏损。
复现建议
需保留匹配初始场景、一分钟时限、失败与安全停止计数,并复用全身控制器。HTML在结果表截断,本次用原PDF补齐实验表与协议;未执行训练。
实验标签与机器人
- 验证范围
- 仿真 + 实物
- 机器人型号
- Unitree G1、Dex3手
相关机器人档案
代码与训练
代码待核实 · 训练代码待核实
仅核对摘要;官方实现、许可证与训练入口尚待核实。
