arrow
返回

Reinforcement learning–based task allocation and path-finding in multi-robot systems under environment uncertainty

delete2025-06-15
delete0
delete
OA
AI
S
Songjun Huang
C
Chuanneng Sun
J
Jie Gong
D
Dario Pompili *
DOI:10.1111/mice.13535delete
delete原文链接
delete分享
delete收藏
查看原文
摘要

摘要

En 中文
自主机器人能够在环境不确定性条件下显著提升多机器人系统(MRSs)的运行效率。在这些场景下实现稳健性能需要有效的任务分配和自适应路径规划。然而,传统的基于模型的框架通常依赖集中式控制或全局信息,因此在通信间歇或地图不可用时显得不切实际。尽管近期研究表明基于强化学习(RL)的框架能够提升性能,但在不同环境中的同步和适应性相关的问题仍未解决。为解决这些问题,本研究提出了“基于不确定性下任务分配与路径规划的强化学习(RL-TAPU)”框架。该框架整合了用于实时任务分配的动作选择双Q学习(ASDQ)算法和用于自适应路径规划的上下文感知元Q学习(CA-MQL)算法。与以往的基于RL的框架不同,RL-TAPU被设计为无需全局地图,仅使用局部状态信息,且能在间歇和低带宽通信条件下可靠运行。任务分配器仅传递最少信息,而路径规划组件能在无需完整环境数据的情况下适应新环境。实验结果显示,RL-TAPU框架展现出更好的适应性,且相较于竞争方案以更短的总执行时间实现了更高的运行效率。
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

C
Computer-Aided Civil and Infrastructure Engineering
IF:
9.1
论文数:
2.0K
被引数:
10.0K

机构

R
rutgers university–new brunswick
学者数:
29
论文数: 13
被引数: 0
引用论文

引用论文

Classical and Heuristic Approaches for Mobile Robot Path Planning: A Survey
err2023-06-27
err0
errOAAI
errJaafar Ahmed Abdulsaheb; Dheyaa Jasim Kadhim
err分享
err收藏
err分享
err收藏
Consensus-Based Decentralized Auctions for Robust Task Allocation
err2009-08-01
err723
errOAAI
errChoi, Han-Lim; Brunet, Luc; How, Jonathan P.
err分享
err收藏
err分享
err收藏
err分享
err收藏
UAV Autonomous Target Search Based on Deep Reinforcement Learning in Complex Disaster Scene
err2019-01-01
err94
errOAAI
errWu, Chunxue; Ju, Bobo; Wu, Yan; Lin, Xiao; Xiong, Naixue; Xu, Guangquan; Li, Hongyan; Liang, Xuefeng
err分享
err收藏
学者 查看更多内容