arrow
Back
S

Shalabh Bhatnagar

indian institute of science

30H-index
362Paper Count
4.6KCitation Count
Published Papers 40
Publication Date
n -step temporal difference learning with optimal n
err2025-06-18
err0
PREAI
errLakshmi Mandal; Shalabh Bhatnagar
errShare
errSave
Truncated Cauchy random perturbations for smoothed functional-based stochastic optimization
err2024-04-01
err2
PREAI
errMondal, Akash; Prashanth, L. A.; Bhatnagar, Shalabh
errShare
errSave
Energy Management in a Cooperative Energy Harvesting Wireless Sensor Network
err2024-01-01
err2
errOAAI
errBarat, Arghyadeep; Prabuchandran, K. J.; Bhatnagar, Shalabh
errShare
errSave
A Generalized Minimax Q-Learning Algorithm for Two-Player Zero-Sum Stochastic Games
err2022-09-01
err4
errOAAI
errDiddigi, Raghuram Bharadwaj; Kamanchi, Chandramouli; Bhatnagar, Shalabh
errShare
errSave
Generalized Second-Order Value Iteration in Markov Decision Processes
err2022-08-01
err3
errOAAI
errKamanchi, Chandramouli; Diddigi, Raghuram Bharadwaj; Bhatnagar, Shalabh
errShare
errSave
Novel First Order Bayesian Optimization with an Application to Reinforcement Learning
err2020-09-30
err15
PREAI
errPrabuchandran, K. J.; Penubothula, Santosh; Kamanchi, Chandramouli; Bhatnagar, Shalabh
errShare
errSave
Reinforcement learning algorithm for non-stationary environments
err2020-06-18
err72
PREAI
errPadakandla, Sindhu; Prabuchandran, K. J.; Bhatnagar, Shalabh
errShare
errSave
Random Directions Stochastic Approximation With Deterministic Perturbations
err2020-06-01
err5
errOAAI
errPrashanth, L. A.; Bhatnagar, Shalabh; Bhavsar, Nirav; Fu, Michael; Marcus, Steven, I
errShare
errSave
A Linearly Relaxed Approximate Linear Program for Markov Decision Processes
err2018-04-01
err22
errOAAI
errLakshminarayanan, Chandrashekar; Bhatnagar, Shalabh; Szepesvari, Csaba
errShare
errSave
A stability criterion for two timescale stochastic approximation schemes
err2017-05-01
err14
PREAI
errLakshminarayanan, Chandrashekar; Bhatnagar, Shalabh
errShare
errSave