arrow
返回
S

Shangdong Yang

Nanjing University of Posts and Telecommunications

7H指数
52论文数
155被引数
收录论文 17
发表时间
err分享
err收藏
Egoism, utilitarianism and egalitarianism in multi-agent reinforcement learning
err2024-10-01
err0
PREAI
errDong, Shaokang; Li, Chao; Yang, Shangdong; An, Bo; Li, Wenbin; Gao, Yang
err分享
err收藏
Selective policy transfer in multi-agent systems with sparse interactions
err2024-09-01
err0
PREAI
errZhuang, Yunkai; Liu, Yong; Yang, Shangdong; Gao, Yang
err分享
err收藏
WToE: Learning When to Explore in Multiagent Reinforcement Learning
err2024-08-01
err1
PREAI
errDong, Shaokang; Mao, Hangyu; Yang, Shangdong; Zhu, Shengyu; Li, Wenbin; Hao, Jianye; Gao, Yang
err分享
err收藏
Modeling Rationality: Toward Better Performance Against Unknown Agents in Sequential Games
err2024-05-01
err1
PREAI
errGe, Zhenxing; Yang, Shangdong; Tian, Pinzhuo; Chen, Zixuan; Gao, Yang
err分享
err收藏
State Abstraction via Deep Supervised Hash Learning基于深度监督哈希学习的状态抽象
err2024-01-01
err0
PREAI
errYang, Guang; Xu, Zheng; Huo, Jing; Yang, Shangdong; Ding, Tianyu; Chen, Xingguo; Gao, Yang
err分享
err收藏
Online attentive kernel-based temporal difference learning
err2023-10-01
err2
errOAAI
errChen, Xingguo; Yang, Guang; Yang, Shangdong; Wang, Huihui; Dong, Shaokang; Gao, Yang
err分享
err收藏
Effective Interpretable Policy Distillation via Critical Experience Point Identification
err2023-09-01
err1
PREAI
errLiu, Xiao; Liu, Shuyang; An, Bo; Gao, Yang; Yang, Shangdong; Li, Wenbin
err分享
err收藏
err分享
err收藏