arrow
返回

Safe Learning for Multi-Robot Mapless Exploration

delete2025-07-04
delete0
delete
OA
AI
W
Wenxing Liu
H
Hanlin Niu
K
Kefan Wu
W
Wei Pan
Z
Ze Ji
R
Robert Skilton
DOI:10.1109/TVT.2025.3581872delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
在利用深度强化学习(DRL)进行多机器人未知环境探索时,训练模型可能因环境复杂性和不可预测性而生成导致系统行为不可预测的动作。因此,确保DRL下的安全探索至关重要。为解决此问题,我们提出了一种多智能体框架,该框架利用基于中间估计器补偿(IEC)的编队方案来应对DRL引入的不确定性,以确保安全探索。所提方案的收敛性通过存在跟踪误差时的李雅普诺夫方法得到验证。针对每个移动机器人,提出了一种基于演员-评论家(actor-critic)的DRL方法以处理避碰任务。为提升DRL训练模型的获取效率,引入了一种基于一致性的训练策略。所提的安全学习框架在模拟和真实世界实验中均成功解决了DRL引入的不确定性,同时确保了无地图探索的实现。
Keyword:
Multi-robot exploration
deep reinforcement learning
intermediate estimator compensation
formation
collision avoidance
Lyapunov methods
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

IEEE Transactions on Vehicular Technology 封面图
IEEE Transactions on Vehicular Technology
IF:
7.1
论文数:
1.8W
被引数:
6.6W

机构

L
lakeside labs gmbh
学者数:
4
论文数: 3
被引数: 0
T
The University of Manchester
学者数:
1.4K
论文数: 643
被引数: 5
C
Cardiff University
学者数:
2.7W
论文数: 2.5W
被引数: 3.5W
学者 查看更多机构
引用论文

引用论文

暂无论文信息