返回报告库

Robotics / NVIDIA

FLARE让机器人不必画出未来,也能学会“先想后做”

关于这篇论文的三个关键问题

FLARE:让机器人不必画出未来,也能学会“先想后做” 解决了什么问题?

机器人行动前,真的需要在脑中生成一张高清“未来照片”吗?FLARE 的回答是:不必。它只让策略学会预测未来画面中与行动有关的压缩特征,同时继续学习该怎么动。

FLARE:让机器人不必画出未来,也能学会“先想后做” 的核心结论有哪些证据?

这张图只比较最直接的对照:同一 FLARE 架构,有没有未来对齐损失。24 个 RoboCasa 厨房任务的平均成功率从 61.9% 升到 70.1%;24 个 GR1 人形机器人桌面任务从 44.0% 升到 55.0%。这分别是 8.2 和 11.0 个百分点,不是“提升 8.2% 和 11%”。

阅读 FLARE:让机器人不必画出未来,也能学会“先想后做” 时最需要注意什么局限?

作者还与 UWM、从头训练的 GR00T N1 和 Diffusion Policy 比较,FLARE 在表 1 的两套平均分上都最高。为控制预训练数据影响,这组实验只用各自域内数据训练嵌入模型;UWM 甚至训练了 400k 步,其他方法为 80k 步。不过,报告的是最后五个检查点中的最高成功率,且这些都是模拟模仿学习任务,不能直接推出开放世界可靠性。(论文第 4.1 节、表 1)

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro