arrow
返回

Self-Evolved Imitation Learning in Simulated World

delete2026-04-13
delete0
PRE
AI
Y
Yifan Ye
J
Jun Cen
J
Jing Chen
Z
Zhihe Lu
DOI:10.1109/LRA.2026.3683594delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
模仿学习已成为近期趋势,但训练一个通用的多任务代理仍然需要大规模专家演示,而收集这些演示成本高昂且劳动密集。为解决监督数据有限的问题,我们提出了自演化模仿学习(SEIL)框架,通过模拟器交互逐步改进少样本模型。模型首先在模拟器中尝试任务,并将成功轨迹收集为新的演示用于迭代优化。为增强演示多样性,SEIL采用双层次增强:(i) 模型层次,使用指数移动平均(EMA)模型与主模型协作;(ii) 环境层次,引入初始物体位置的轻微变化。此外,我们引入了一个轻量级选择器,从生成池中筛选互补且信息丰富的轨迹以确保演示质量。这些精选样本使模型能够用远少得多的训练样例实现有竞争力的性能。在LIBERO基准上的大量实验表明,SEIL在少样本模仿学习方面达到了新的最佳性能,代码可在https://github.com/Jasper-aaa/SEIL.git获取。
Keyword:
Imitation learning
vision-language-action model
few-shot learning

期刊

I
IEEE Robotics and Automation Letters
IF:
5.3
论文数:
1.9K
被引数:
3.9W

机构

H
Hamad bin Khalifa University
学者数:
358
论文数: 149
被引数: 0
G
guangdong university of technology
学者数:
3.0W
论文数: 2.0W
被引数: 36
Z
zhejiang university
学者数:
17.7W
论文数: 12.1W
被引数: 152
学者 查看更多机构
引用论文

引用论文

RT-1: Robotics Transformer for Real-World Control at Scale
err2023-07-10
err0
errOAAI
errAnthony Brohan; Noah Brown; Justice Carbajal; Yevgen Chebotar; Joseph Dabis; Chelsea Finn; Keerthana Gopalakrishnan; Karol Hausman; Alexander Herzog; Jasmine Hsu; Julian Ibarz; Brian Ichter; Alex Irpan; Tomas Jackson; Sally Jesmonth; Nikhil Joshi; Ryan Julian; Dmitry Kalashnikov; Yuheng Kuang; Isabel Leal; Kuang-Huei Lee; Sergey Levine; Yao Lu; Utsav Malla; Deeksha Manjunath; Igor Mordatch; Ofir Nachum; Carolina Parada; Jodilyn Peralta; Emily Perez; Karl Pertsch; Jornell Quiambao; Kanishka Rao; Michael Ryoo; Grecia Salazar; Pannag Sanketi; Kevin Sayed; Jaspiar Singh; Sumedh Sontakke; Austin Stone; Clayton Tan; Huong Tran; Vincent Vanhoucke; Steve Vega; Quan Vuong; Fei Xia; Ted Xiao; Peng Xu; Sichun Xu; Tianhe Yu; Brianna Zitkovich
err分享
err收藏
err分享
err收藏
Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware
err2023-07-10
err0
errOAAI
errTony Zhao; Vikash Kumar; Sergey Levine; Chelsea Finn
err分享
err收藏
Behavior Transformers: Cloning k Modes with One Stone
err2022-01-01
err0
PREAI
errShafiullah,Nur Muhammad; Cui,Zichen; Altanzaya,Ariuntuya (Arty); Pinto,Lerrel
err分享
err收藏
Deep Reinforcement Learning: A Brief Survey深度强化学习: 简要综述
err2017-11-01
err0
errOAAI
errKai Arulkumaran; Marc Peter Deisenroth; Miles Brundage; Anil Anthony Bharath
err分享
err收藏
Offline Meta-Reinforcement Learning for Industrial Insertion
err2022-05-23
err0
errOAAI
errTony Z. Zhao; Jianlan Luo; Oleg Sushkov; Rugile Pevceviciute; Nicolas Heess; Jon Scholz; Stefan Schaal; Sergey Levine
err分享
err收藏
err分享
err收藏
学者 查看更多内容