返回报告库

Robotics / Humanoid

ASAP让模拟器学会复现真机的失败

关于这篇论文的三个关键问题

ASAP:让模拟器学会复现真机的失败 解决了什么问题?

这篇论文换了一个修补“仿真到现实”落差的角度:不先猜真机到底是哪项物理参数不准,而是让 Unitree G1 的真实失败告诉模拟器“同一个动作指令还差多少”,再让控制策略在这种更像真机的失败里重新练习。

ASAP:让模拟器学会复现真机的失败 的核心结论有哪些证据?

训练时,模拟器会奖励它贴近参考动作,也会惩罚摔倒、超出关节或扭矩限制、打滑和动作突变。早期允许身体离参考轨迹最多 1.5 米,随后收紧到 0.3 米;每次训练还随机从动作中段开始,所以策略可以分别练起跳和落地,而不必每次从第一帧熬到最后一帧。(论文第 II-B 节)

阅读 ASAP:让模拟器学会复现真机的失败 时最需要注意什么局限?

训练时,模拟器会奖励它贴近参考动作,也会惩罚摔倒、超出关节或扭矩限制、打滑和动作突变。早期允许身体离参考轨迹最多 1.5 米,随后收紧到 0.3 米;每次训练还随机从动作中段开始,所以策略可以分别练起跳和落地,而不必每次从第一帧熬到最后一帧。(论文第 II-B 节)

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro