arrow
Return

Safe Approximate Dynamic Programming via Kernelized Lipschitz Estimation

delete2021-01-01
delete12
delete
OA
AI
A
Ankush Chakrabarty *
D
Devesh K. Jha
G
Gregery T. Buzzard
Y
Yebin Wang
K
Kyriakos G. Vamvoudakis
DOI:10.1109/TNNLS.2020.2978805delete
deleteOriginal
deleteShare
deleteSave
View PDF
Abstract

Abstract

En 中文
We develop a method for obtaining safe initial policies for reinforcement learning via approximate dynamic programming (ADP) techniques for uncertain systems evolving with discrete-time dynamics. We employ the kernelized Lipschitz estimation to learn multiplier matrices that are used in semidefinite programming frameworks for computing admissible initial control policies with provably high probability. Such admissible controllers enable safe initialization and constraint enforcement while providing exponential stability of the equilibrium of the closed-loop system.
Keywords:
Estimation
Dynamic programming
Learning systems
Kernel
Safety
Data models
Programming
Approximate dynamic programming (ADP)
data-driven Lipschitz constant estimation
incremental quadratic constraints
kernel density estimation (KDE)
semidefinite programming
AI Summary

AI Summary

Key information extracted from the uploaded paper, including a brief overview, abstract, background, key highlights, visual analysis, and future outlook.

Journal

IEEE Transactions on Neural Networks and Learning Systems cover
IEEE Transactions on Neural Networks and Learning Systems
IF:
8.9
Papers:
7.5K
Citations:
7.2W

Organization

Purdue University System cover
Purdue University System
Scholars:
3.9W
Papers: 3.6W
Citations: 66
U
university system of georgia
Scholars:
7.3W
Papers: 6.5W
Citations: 101
P
Purdue University
Scholars:
2.6W
Papers: 2.1W
Citations: 147
researcher View more organizations