arrow
返回

Risk-Sensitive Markov Decision Processes

delete1972-03-01
delete0
PRE
AI
DOI:10.1287/mnsc.18.7.356delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
This paper considers the maximization of certain equivalent reward generated by a Markov decision process with constant risk sensitivity. First, value iteration is used to optimize possibly time-varying processes of finite duration. Then a policy iteration procedure is developed to find the stationary policy with highest certain equivalent gain for the infinite duration case. A simple example demonstrates both procedures.
AI总结

AI总结

对已上传原文的论文进行重点信息的提取,主要内容包括:简要概述、研究摘要、背景介绍、关键亮点、图文解析、展望与总结。

期刊

暂无期刊信息

机构

暂无机构信息
引用论文

引用论文

暂无论文信息