科言猫
学术研究的AI总结
首页
文献互助
订阅
我的收藏
科研工具
选题分析
论文总结
专利管理
未登录
返回
S
Shalabh Bhatnagar
indian institute of science
30
H指数
362
论文数
4.6K
被引数
0
相关解读
订阅
收录论文
40
发表时间
发表时间
IF
被引数
An Actor–Critic Algorithm With Function Approximation for Risk Sensitive Cost Markov Decision Processes
一种带函数近似的面向风险敏感成本马尔可夫决策过程的演员-评论家算法
IEEE Transactions on Automatic Control
IF
7
2025-07-28
0
PRE
AI
Soumyajit Guin; Vivek S. Borkar; Shalabh Bhatnagar
分享
收藏
Generalized Simultaneous Perturbation-Based Gradient Search With Reduced Estimator Bias
广义基于同时扰动的梯度搜索与估计器偏差降低
IEEE Transactions on Automatic Control
IF
7
2025-07-01
0
PRE
AI
Soumen Pachal; Shalabh Bhatnagar; Prashanth L. A.
分享
收藏
n -step temporal difference learning with optimal n
最优n步时间差分学习
Automatica
IF
5.9
2025-06-18
0
PRE
AI
Lakshmi Mandal; Shalabh Bhatnagar
分享
收藏
Truncated Cauchy random perturbations for smoothed functional-based stochastic optimization
AUTOMATICA
IF
5.9
2024-04-01
2
PRE
AI
Mondal, Akash; Prashanth, L. A.; Bhatnagar, Shalabh
分享
收藏
Energy Management in a Cooperative Energy Harvesting Wireless Sensor Network
IEEE COMMUNICATIONS LETTERS
IF
4.4
2024-01-01
2
OA
AI
Barat, Arghyadeep; Prabuchandran, K. J.; Bhatnagar, Shalabh
分享
收藏
A Generalized Minimax Q-Learning Algorithm for Two-Player Zero-Sum Stochastic Games
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2022-09-01
4
OA
AI
Diddigi, Raghuram Bharadwaj; Kamanchi, Chandramouli; Bhatnagar, Shalabh
分享
收藏
Generalized Second-Order Value Iteration in Markov Decision Processes
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2022-08-01
3
OA
AI
Kamanchi, Chandramouli; Diddigi, Raghuram Bharadwaj; Bhatnagar, Shalabh
分享
收藏
Stochastic Approximation With Iterate-Dependent Markov Noise Under Verifiable Conditions in Compact State Space With the Stability of Iterates Not Ensured
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2021-12-01
5
PRE
AI
Karmakar, Prasenjit; Bhatnagar, Shalabh
分享
收藏
Asynchronous Stochastic Approximations With Asymptotically Biased Errors and Deep Multiagent Learning
具有渐近有偏误差和深度多智能体学习的异步随机逼近
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2021-09-01
0
OA
AI
Ramaswamy, Arunselvan; Bhatnagar, Shalabh; Quevedo, Daniel E.
分享
收藏
Memory-Based Deep Reinforcement Learning for Obstacle Avoidance in UAV With Limited Environment Knowledge
基于记忆的深度强化学习在有限环境知识下的无人机避障
IEEE TRANSACTIONS ON INTELLIGENT TRANSPORTATION SYSTEMS
IF
8.4
2021-01-01
148
OA
AI
Singla, Abhik; Padakandla, Sindhu; Bhatnagar, Shalabh
分享
收藏
Novel First Order Bayesian Optimization with an Application to Reinforcement Learning
APPLIED INTELLIGENCE
IF
3.5
2020-09-30
15
PRE
AI
Prabuchandran, K. J.; Penubothula, Santosh; Kamanchi, Chandramouli; Bhatnagar, Shalabh
分享
收藏
Reinforcement learning algorithm for non-stationary environments
面向非平稳环境的强化学习算法
APPLIED INTELLIGENCE
IF
3.5
2020-06-18
72
PRE
AI
Padakandla, Sindhu; Prabuchandran, K. J.; Bhatnagar, Shalabh
分享
收藏
Random Directions Stochastic Approximation With Deterministic Perturbations
随机方向确定性扰动的随机近似
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2020-06-01
5
OA
AI
Prashanth, L. A.; Bhatnagar, Shalabh; Bhavsar, Nirav; Fu, Michael; Marcus, Steven, I
分享
收藏
Analysis of Stochastic Approximation Schemes With Set-Valued Maps in the Absence of a Stability Guarantee and Their Stabilization
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2020-03-01
4
OA
AI
Yaji, Vinayaka G.; Bhatnagar, Shalabh
分享
收藏
Stability of Stochastic Approximations With Controlled Markov Noise and Temporal Difference Learning
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2019-06-01
9
OA
AI
Ramaswamy, Arunselvan; Bhatnagar, Shalabh
分享
收藏
An online prediction algorithm for reinforcement learning with linear function approximation using cross entropy method
MACHINE LEARNING
IF
2.9
2018-07-03
10
OA
AI
Joseph, Ajin George; Bhatnagar, Shalabh
分享
收藏
Analysis of Gradient Descent Methods With Nondiminishing Bounded Errors
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2018-05-01
10
OA
AI
Ramaswamy, Arunselvan; Bhatnagar, Shalabh
分享
收藏
A Linearly Relaxed Approximate Linear Program for Markov Decision Processes
马尔可夫决策过程的线性松弛近似线性规划
IEEE TRANSACTIONS ON AUTOMATIC CONTROL
IF
7
2018-04-01
22
OA
AI
Lakshminarayanan, Chandrashekar; Bhatnagar, Shalabh; Szepesvari, Csaba
分享
收藏
An incremental off-policy search in a model-free Markov decision process using a single sample path
使用单个样本路径在无模型马尔可夫决策过程中进行增量策略外搜索
MACHINE LEARNING
IF
2.9
2018-02-13
2
OA
AI
Joseph, Ajin George; Bhatnagar, Shalabh
分享
收藏
A stability criterion for two timescale stochastic approximation schemes
AUTOMATICA
IF
5.9
2017-05-01
14
PRE
AI
Lakshminarayanan, Chandrashekar; Bhatnagar, Shalabh
分享
收藏
研究方向
暂无研究方向
合作学者
合作期刊
C
Csaba Szepesvári
H 指数: 57 · 论文数: 471
D
Daniel E. Quevedo
H 指数: 53 · 论文数: 409
M
Michael C. Fu
H 指数: 49 · 论文数: 610
V
Vivek S. Borkar
H 指数: 49 · 论文数: 543
S
Steven I. Marcus
H 指数: 48 · 论文数: 321
查看更多