arrow
返回

Learning Robust Representations via Bidirectional Transition for Visual Reinforcement Learning

delete2025-10-15
delete0
PRE
AI
X
Xiaobo Hu
Y
Youfang Lin
J
Jinwen Wang
刘月 封面图
刘月 (Yue Liu)
S
Shuo Wang
H
Hehe Fan
吕
吕凯 (Kai Lv)
DOI:10.1145/3765517delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
视觉强化学习已展现出解决具有高维观测的控制任务的效能。然而,一个核心挑战在于如何从基于视觉的观测中推导出可靠且泛化的表征。受人类思维过程的启发,当从观测中提取的视觉表征能够预测未来并追溯历史时,该表征在理解环境状态方面是可靠且准确的。基于此概念,我们引入了一种双向转换(BT)框架用于表征学习。该框架采用正向和反向环境转换的双向预测作为辅助任务,以提取可靠表征。此外,我们引入了一个逆动力学模型来预测导致环境状态转换的动作,从而学习状态表征的任务相关性。在DeepMind Control套件的两个设置中,我们的方法展示了具有竞争力的泛化性能和样本效率。此外,我们利用机器人操作模拟器、自动驾驶模拟器CARLA以及视觉导航模拟器Habitat来展示我们方法广泛的适用性。结果表明,BT提供了更稳定可靠的表征,并表现出对视觉强化学习任务强大的泛化性能。

期刊

A
acm transactions on multimedia computing; communications and applications
IF:
0
论文数:
50
被引数:
0

机构

暂无机构信息
引用论文

引用论文

A Systematic Study on Reinforcement Learning Based Applications基于强化学习的应用系统研究
err2023-02-03
err27
errOAAI
errSivamayil, Keerthana; Rajasekar, Elakkiya; Aljafari, Belqasem; Nikolovski, Srete; Vairavasundaram, Subramaniyaswamy; Vairavasundaram, Indragandhi
err分享
err收藏
Look Closer: Bridging Egocentric and Third-Person Views With Transformers for Robotic Manipulation
err2022-04-01
err0
errOAAI
errRishabh Jangir; Nicklas Hansen; Sambaran Ghosal; Mohit Jain; Xiaolong Wang
err分享
err收藏
Skill-Based Hierarchical Reinforcement Learning for Target Visual Navigation
err2023-01-01
err9
PREAI
errWang, Shuo; Wu, Zhihao; Hu, Xiaobo; Lin, Youfang; Lv, Kai
err分享
err收藏
err
IF0
err
err0
PREAI
err
err分享
err收藏
err分享
err收藏
Bisimulation Metrics for Continuous Markov Decision Processes
err2011-01-01
err0
PREAI
errNorm Ferns; Prakash Panangaden; Doina Precup
err分享
err收藏
学者 查看更多内容