arrow
返回

Scalable path planning algorithm for multi-Unmanned Surface Vehicles based on Multi-Agent Deep Deterministic Policy Gradient

delete2025-03-01
delete1
PRE
AI
高
高强 (Qiang Gao)
S
Shuhao Li
吉
吉月辉 (Yuehui Ji)
刘
刘俊杰 (Junjie Liu)
宋
宋雨 (Yu Song)
DOI:10.1016/j.oceaneng.2024.120243delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本文针对多无人水面艇(USV)系统的协同路径规划问题展开研究。基于多智能体深度确定性策略梯度(MADDPG)框架,提出了一种多-USV路径规划算法。相较于传统MADDPG,所提算法采用基于邻近观测构建观测空间策略,通过提取邻近USV和障碍物的关键信息来减少数据量并提升可扩展性。此外,引入了一种优先考虑最新经验的混合采样策略以提高学习效率,并采用软更新策略更新目标网络参数。进一步地,设计了融合残差网络和预处理网络的Critic网络模型,以提升训练效率和稳定性。仿真结果表明,与MADDPG及其他四种算法相比,所提方法具有更优的训练效果和更强的可扩展性,路径规划更为合理高效,能够实现不同场景下的多-USV路径规划。
Keyword:
Multi-unmanned surface vehicles
Deep deterministic policy gradient
Path planning
Adjacent observation
Improved experience replay
Residual network

期刊

Ocean Engineering 封面图
Ocean Engineering
IF:
5.5
论文数:
7.3K
被引数:
7.6W

机构

T
Tianjin Univ Technol
学者数:
849
论文数: 311
被引数: 115
引用论文

引用论文

err分享
err收藏
err分享
err收藏
Fast marching square method based intelligent navigation of the unmanned surface vehicle swarm in restricted waters
err2020-02-01
err51
PREAI
errTan, Guoge; Zou, Jin; Zhuang, Jiayuan; Wan, Lei; Sun, Hanbing; Sun, Zhiyuan
err分享
err收藏
Reinforcement Learned Distributed Multi-Robot Navigation With Reciprocal Velocity Obstacle Shaped Rewards
err2022-07-01
err0
errOAAI
errRuihua Han; Shengduo Chen; Shuaijun Wang; Zeqing Zhang; Rui Gao; Qi Hao; Jia Pan
err分享
err收藏
学者 查看更多内容