arrow
Back
Y

Yaodong Yang

peking university

32H-index
319Paper Count
4.0KCitation Count
Published Papers 26
Publication Date
ECO: Energy-Constrained Optimization With Reinforcement Learning for Humanoid Walking
err2026-02-13
err0
PREAI
errWeidong Huang; Jingwen Zhang; Jiongye Li; Shibowen Zhang; Jiayang Wu; Jiayi Wang; Hangxin Liu; Yaodong Yang; Yao Su
errShare
errSave
MT-dyna: A framework for evaluating multi-turn capabilities of LLMs
err2026-02-10
err0
PREAI
errJun Gao; Junlin Cui; Anwen Yang; Yiqi Tong; Huijia Wu; Xiangzheng Zhang; Yaodong Yang; Zhaofeng He
errShare
errSave
AI Alignment: A Contemporary Survey
err2025-11-21
err0
errOAAI
errJiaming Ji; Tianyi Qiu; Boyuan Chen; Jiayi Zhou; Borong Zhang; Donghai Hong; Hantao Lou; Kaile Wang; Yawen Duan; Zhonghao He; Lukas Vierling; Zhaowei Zhang; Fanzhi Zeng; Juntao Dai; Xuehai Pan; Hua Xu; Aidan O'Gara; Kwan Ng; Brian Tse; Jie Fu; Stephen Mcaleer; Yanfeng Wang; Mingchuan Yang; Yunhuai Liu; Yizhou Wang; Song-Chun Zhu; Yike Guo; Yaodong Yang; Wen Gao
errShare
errSave
ReDMan: reliable dexterous manipulation with safe reinforcement learning
err2025-07-14
err0
PREAI
errYiran Geng; Jiaming Ji; Yuanpei Chen; Haoran Geng; Fangwei Zhong; Yaodong Yang
errShare
errSave
Can large language models independently complete tasks? A dynamic evaluation framework for multi-turn task planning and completion
err2025-07-01
err0
PREAI
errGao, Jun; Cui, Junlin; Wu, Huijia; Xiang, Liuyu; Zhao, Han; Li, Xiangang; Fang, Meng; Yang, Yaodong; He, Zhaofeng
errShare
errSave
Attacking cooperative multi-agent reinforcement learning by adversarial minority influence
err2025-06-21
err0
errOAAI
errSimin Li; Jun Guo; Jingqiao Xiu; Yuwei Zheng; Pu Feng; Xin Yu; Jiakai Wang; Aishan Liu; Yaodong Yang; Bo An; Wenjun Wu; Xianglong Liu
errShare
errSave
Med-Aligner empowers LLM medical applications for complex medical scenarios
err2025-06-19
err0
errOAAI
errXiangbin Meng; Jia-ming Ji; Xiangyu Yan; Jun-tao Dai; Bo-yuan Chen; Guan Wang; Hua Xu; Jing-jia Wang; Xu-liang Wang; Da Liu; Ming-qi Zheng; Rongzhou Wu; Chuanjie Wu; Yuwei Wu; Wen-yao Wang; Zhen Song; Yaodong Yang
errShare
errSave
TIMAR: Transition-informed representation for sample-efficient multi-agent reinforcement learning
err2025-04-01
err0
PREAI
errFeng, Mingxiao; Yang, Yaodong; Zhou, Wengang; Li, Houqiang
errShare
errSave
Revolutionizing Health Care: The Transformative Impact of Large Language Models in Medicine
err2025-01-07
err1
errOAAI
errZhang, Kuo; Meng, Xiangbin; Yan, Xiangyu; Ji, Jiaming; Liu, Jingqian; Xu, Hua; Zhang, Heng; Liu, Da; Wang, Jingjia; Wang, Xuliang; Gao, Jun; Wang, Yuan-geng-shuo; Shao, Chunli; Wang, Wenyao; Li, Jiarong; Zheng, Ming-Qi; Yang, Yaodong; Tang, Yi-Da
errShare
errSave
Adaptive pessimism via target Q-value for offline reinforcement learning
err2024-12-01
err0
errOAAI
errLiu, Jie; Zhang, Yinmin; Li, Chuming; Yang, Yaodong; Liu, Yu; Ouyang, Wanli
errShare
errSave
Efficient and scalable reinforcement learning for large-scale network control
err2024-09-03
err0
errOAAI
errMa, Chengdong; Li, Aming; Du, Yali; Dong, Hao; Yang, Yaodong
errShare
errSave
Self-Supervised MAFENN for Classifying Low-Labeled Distorted Images Over Mobile Fading Channels
err2024-08-01
err0
PREAI
errLi, Yang; Sun, Fanglei; Hu, Jingchen; Liu, Chang; Wu, Fan; Li, Kai; Wen, Ying; Tian, Zheng; Yang, Yaodong; Zhu, Jiangcheng; Chen, Zhifeng; Wang, Jun; Yang, Yang
errShare
errSave
Integrated transcriptomics and metabolomics analyses of the effects of bagging treatment on carotenoid biosynthesis and regulation of Areca catechu L.
err2024-04-02
err0
errOAAI
errZheng, Xin; Huang, Liyun; Fan, Benyi; Peng, Chunlin; Iqbal, Amjad; Zhang, Yujie; Chen, Hongman; Ye, Jianqiu; Yang, Yaodong
errShare
errSave
Investigation of regenerative braking for the electric mining truck based on fuzzy control
err2024-01-01
err0
PREAI
errLuo, Denghao; Yang, Weiwei; Wang, Yilin; Han, Yijun; Liu, Qiang; Yang, Yaodong
errShare
errSave
Large sequence models for sequential decision-making: a survey
err2023-08-05
err24
errOAAI
errWen, Muning; Lin, Runji; Wang, Hanjing; Yang, Yaodong; Wen, Ying; Mai, Luo; Wang, Jun; Zhang, Haifeng; Zhang, Weinan
errShare
errSave
Safe multi-agent reinforcement learning for multi-robot control
err2023-06-01
err44
errOAAI
errGu, Shangding; Kuba, Jakub Grudzien; Chen, Yuanpei; Du, Yali; Yang, Long; Knoll, Alois; Yang, Yaodong
errShare
errSave
Offline Pre-trained Multi-agent Decision Transformer
err2023-03-31
err10
errOAAI
errMeng, Linghui; Wen, Muning; Le, Chenyang; Li, Xiyun; Xing, Dengpeng; Zhang, Weinan; Wen, Ying; Zhang, Haifeng; Wang, Jun; Yang, Yaodong; Xu, Bo
errShare
errSave
errShare
errSave