返回
Path planning based on improved deep Q-network algorithm for bionic robotic fish with ocean currents
DOI:10.1016/j.neucom.2025.131173.png)
摘要
En 中文
• 动态集成奖励机制。为了解决BRF路径规划的多目标优化问题,提出了一种动态集成奖励机制,以在存在洋流的环境中提升优化性能。
• 动态两步动作选择策略。该策略被提出用于调整探索与利用之间的平衡,它不仅能在早期训练阶段保证代理对复杂环境的充分探索,还能在后期训练阶段明确利用高价值动作以提高学习效率和收敛速度。
• 双层动态学习率。本文提出了双层动态学习率,该机制可缓解过拟合、提升模型泛化能力并增强其鲁棒性,这有助于在不同未知环境中获得最优BRF路径。
Keyword:
BRF path planning
dynamic integrated reward mechanism
two-step action-selection strategy
double-level dynamic learning rate
multi-objective optimization
期刊
IF:
6.5
论文数:
2.5W
被引数:
6.5W
机构
引用论文
暂无论文信息

