返回
A robust time-inconsistent linear-quadratic problem
DOI:10.1002/rnc.5426.png)
摘要
En 中文
本文涉及具有模型不确定性的确定性时间不一致的线性二次最优控制,其中非指数时间折扣出现在目标函数中。如果将目标函数视为寿命范围内的输出/观察值,则在极小极大优化的原理下对该时间不一致的线性二次问题的干扰衰减进行建模和求解,并采用时间不一致的零和线性二次动态博弈,控制器是最小化玩家,干扰是假想的最大化玩家。引入鲁棒混合均衡解的定义,充分刻画了其存在性。构造了一个示例,以表明即使某些初始对既不存在开环平衡控制也不存在反馈平衡策略,所有初始对都存在混合平衡解。此外,对于零和线性二次博弈的时间一致版本,给出了另一个例子来表明开环时间一致均衡的存在并不意味着开环预承诺均衡的存在。
Keyword:
dynamic game
precommitted policy
stochastic linear‐ quadratic problem
time inconsistency
time‐ consistent policy
AI总结
对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。
期刊
IF:
3.2
论文数:
7.0K
被引数:
1.4W

