arrow
返回

Regularized Q-Learning With Linear Function Approximation

delete2025-07-25
delete0
PRE
AI
J
Jiachen Xi
A
Alfredo Garcia
P
Petar Momčilović
DOI:10.1109/TAC.2025.3592801delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
我们考虑一种用于带正则化Q学习的线性函数近似的单循环算法。所提出的算法受到正则化Q学习的一种双层优化形式的启发,其中下级优化问题旨在识别满足Bellman递归最优性条件的价值函数近似,而上级优化问题旨在找到投影到基向量张成空间中的解。我们证明,在特定假设下,所提出的算法在马尔可夫噪声存在的情况下收敛到平稳点。此外,我们为从所提出算法中导出的策略提供了性能保证。
Keyword:
Linear function approximation
Q-learning
reinforcement learning

期刊

IEEE Transactions on Automatic Control 封面图
IEEE Transactions on Automatic Control
IF:
7
论文数:
1.3W
被引数:
6.7W

机构

T
Texas A&M University
学者数:
3.7K
论文数: 1.8K
被引数: 5.1W
引用论文

引用论文

Finite-time error bounds for Greedy-GQ
err2024-04-30
err0
PREAI
errWang, Yue; Zhou, Yi; Zou, Shaofeng
err分享
err收藏
学者 查看更多内容