arrow
返回

Adjustable behavior-guided adaptive dynamic programming for neural learning control

delete2025-07-01
delete0
PRE
AI
G
Guohan Tang
王
王丁 (Ding Wang) *
A
Ao Liu
J
Junfei Qiao
DOI:10.1016/j.neucom.2025.129986delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
本文设计了一种可调的行为引导自适应动态规划(BGADP)算法,用于解决离散时间系统的最优调节问题。在传统的自适应动态规划方法中,进行策略改进需要系统的梯度信息。然而,当无法计算梯度信息或系统动力学不可微时,这些方法面临挑战。为克服这些局限性,本文采用一种受人类行为启发的群智能方法,在迭代过程中搜索更优策略,从而无需梯度信息。此外,在值函数更新中引入松弛因子,以加速算法的收敛速度。文中严格分析了迭代值函数的单调性和收敛性。最后,通过两个基于神经网络actor-critic框架实现的仿真研究,验证了可调BGADP算法的有效性和实用性。
Keyword:
Adaptive dynamic programming
Brain storm optimization
Convergence rate
Neural networks
Optimal control
Swarm intelligence

期刊

Neurocomputing 封面图
Neurocomputing
IF:
6.5
论文数:
2.5W
被引数:
6.5W

机构

B
Beijing Univ Technol
学者数:
2.6K
论文数: 1.2K
被引数: 354
引用论文

引用论文

err分享
err收藏
Adaptive optimal control for reference tracking independent of exo-system dynamics
err2020-09-01
err7
errOAAI
errKoepf, Florian; Westermann, Johannes; Flad, Michael; Hohmann, Soeren
err分享
err收藏
学者 查看更多内容