arrow
返回

Sign potential-driven multiplicative optimization for robust deep reinforcement learning

delete2025-05-27
delete0
PRE
AI
L
Loukia Avramelou *
M
Manos Kirtas
N
Nikolaos Passalis
A
Anastasios Tefas
DOI:10.1016/j.neunet.2025.107492delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
深度强化学习(DRL)因其能够为不同领域(如机器人技术、自动驾驶、金融交易等)的各类问题提供有价值的解决方案而引起了研究人员的兴趣。然而,DRL模型通常较为敏感,在训练和评估过程中表现出不稳定的行为,这增加了人们对实施鲁棒方法以增强DRL训练过程的研究兴趣。考虑到基于乘性更新的优化方法在收敛性和鲁棒性方面已显示出优于加性更新的优势,我们提出了一种新颖的基于动量的优化方法,该方法克服了现有方法的重大局限性,例如乘性更新无法翻转参数符号的问题。更具体地说,所提出的方法采用了一种受脉冲神经网络启发的符号变化机制,允许参数改变符号,从而在加速学习和增强鲁棒性方面有利于训练过程。该提出的优化器旨在训练DRL智能体,并在多种任务中进行了实验评估,证明了其在DRL智能体训练中的有效性。
Keyword:
Optimization
Multiplicative optimizer
Deep reinforcement learning

期刊

Neural Networks 封面图
Neural Networks
IF:
6.3
论文数:
7.8K
被引数:
3.0W

机构

A
Aristotle Univ Thessaloniki
学者数:
1.3K
论文数: 603
被引数: 244
引用论文

引用论文

err分享
err收藏
Training much deeper spiking neural networks with a small number of time-steps用少量的时间步长训练更深的尖峰神经网络
err2022-09-01
err18
PREAI
errMeng, Qingyan; Yan, Shen; Xiao, Mingqing; Wang, Yisen; Lin, Zhouchen; Luo, Zhi-Quan
err分享
err收藏
Pandia
err2024-04-17
err0
errOAAI
errXuebing Li; Esa Vikberg; Byungjin Cho; Yu Xiao
err分享
err收藏
学者 查看更多内容