arrow
返回

Efficiently Learning Robust Torque-Based Locomotion Through Reinforcement With Model-Based Supervision

delete2026-02-13
delete0
PRE
AI
Y
Yashuai Yan
T
Tobias Egle
C
Christian Ott
D
Dongheui Lee
DOI:10.1109/LRA.2026.3664534delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
我们提出了一种控制框架,将基于模型的步态行走与残差强化学习(RL)相结合,以在存在真实世界不确定性的情况下实现鲁棒且自适应的行走。我们的方法利用一个基于模型的控制器——包括一个发散运动分量(DCM)轨迹规划器和全身控制器——作为可靠的基础策略。为解决动力学建模不准确和传感器噪声的不确定性,我们引入了一种通过领域随机化训练的残差策略。关键在于,我们采用一个基于模型的先验策略,该策略在训练期间可获取动力学真值信息,通过一种新颖的监督损失来监督残差策略。这种监督使策略能够高效学习修正行为,以补偿未建模的影响,而无需进行大量的奖励塑造。我们的方法在一系列随机化条件下展示了改进的鲁棒性和泛化能力,为双足步态行走中的仿真到现实迁移提供了一种可扩展的解决方案。
Keyword:
Bipedal locomotion
sim-to-real transfer
residual RL
model-based control

期刊

I
IEEE Robotics and Automation Letters
IF:
5.3
论文数:
1.9K
被引数:
3.9W

机构

T
tu wien
学者数:
717
论文数: 244
被引数: 0
引用论文

引用论文

Learning Torque Control for Quadrupedal Locomotion
err2023-12-12
err0
errOAAI
errShuxiao Chen; Bike Zhang; Mark W. Mueller; Akshara Rai; Koushil Sreenath
err分享
err收藏
Dynamic Bipedal Turning through Sim-to-Real Reinforcement Learning
err2022-11-28
err0
PREAI
errFangzhou Yu; Ryan Batke; Jeremy Dao; Jonathan Hurst; Kevin Green; Alan Fern
err分享
err收藏
err分享
err收藏
Unified Motion Planner for Walking, Running, and Jumping Using the Three-Dimensional Divergent Component of Motion
err2023-12-01
err2
errOAAI
errMesesan, George; Schuller, Robert; Englsberger, Johannes; Ott, Christian; Albu-Schaffer, Alin
err分享
err收藏
学者 查看更多内容