arrow
返回
Y

Yaodong Yang

peking university

32H指数
319论文数
4.0K被引数
收录论文 26
发表时间
err分享
err收藏
MT-dyna: A framework for evaluating multi-turn capabilities of LLMsMT-dyna: 一种用于评估LLMs多轮能力的框架
err2026-02-10
err0
PREAI
errJun Gao; Junlin Cui; Anwen Yang; Yiqi Tong; Huijia Wu; Xiangzheng Zhang; Yaodong Yang; Zhaofeng He
err分享
err收藏
AI Alignment: A Contemporary Survey人工智能对齐: 当代调查
err2025-11-21
err0
errOAAI
errJiaming Ji; Tianyi Qiu; Boyuan Chen; Jiayi Zhou; Borong Zhang; Donghai Hong; Hantao Lou; Kaile Wang; Yawen Duan; Zhonghao He; Lukas Vierling; Zhaowei Zhang; Fanzhi Zeng; Juntao Dai; Xuehai Pan; Hua Xu; Aidan O'Gara; Kwan Ng; Brian Tse; Jie Fu; Stephen Mcaleer; Yanfeng Wang; Mingchuan Yang; Yunhuai Liu; Yizhou Wang; Song-Chun Zhu; Yike Guo; Yaodong Yang; Wen Gao
err分享
err收藏
ReDMan: reliable dexterous manipulation with safe reinforcement learningReDMan:可靠灵巧操作与安全强化学习
err2025-07-14
err0
PREAI
errYiran Geng; Jiaming Ji; Yuanpei Chen; Haoran Geng; Fangwei Zhong; Yaodong Yang
err分享
err收藏
Attacking cooperative multi-agent reinforcement learning by adversarial minority influence通过对抗性少数群体影响攻击合作多智能体强化学习
err2025-06-21
err0
errOAAI
errSimin Li; Jun Guo; Jingqiao Xiu; Yuwei Zheng; Pu Feng; Xin Yu; Jiakai Wang; Aishan Liu; Yaodong Yang; Bo An; Wenjun Wu; Xianglong Liu
err分享
err收藏
Med-Aligner empowers LLM medical applications for complex medical scenariosMed-Aligner为复杂医疗场景赋能大语言模型医疗应用
err2025-06-19
err0
errOAAI
errXiangbin Meng; Jia-ming Ji; Xiangyu Yan; Jun-tao Dai; Bo-yuan Chen; Guan Wang; Hua Xu; Jing-jia Wang; Xu-liang Wang; Da Liu; Ming-qi Zheng; Rongzhou Wu; Chuanjie Wu; Yuwei Wu; Wen-yao Wang; Zhen Song; Yaodong Yang
err分享
err收藏
Revolutionizing Health Care: The Transformative Impact of Large Language Models in Medicine革命性的医疗保健: 大型语言模型在医学中的变革性影响
err2025-01-07
err1
errOAAI
errZhang, Kuo; Meng, Xiangbin; Yan, Xiangyu; Ji, Jiaming; Liu, Jingqian; Xu, Hua; Zhang, Heng; Liu, Da; Wang, Jingjia; Wang, Xuliang; Gao, Jun; Wang, Yuan-geng-shuo; Shao, Chunli; Wang, Wenyao; Li, Jiarong; Zheng, Ming-Qi; Yang, Yaodong; Tang, Yi-Da
err分享
err收藏
Adaptive pessimism via target Q-value for offline reinforcement learning基于目标q值的自适应悲观离线强化学习
err2024-12-01
err0
errOAAI
errLiu, Jie; Zhang, Yinmin; Li, Chuming; Yang, Yaodong; Liu, Yu; Ouyang, Wanli
err分享
err收藏
Efficient and scalable reinforcement learning for large-scale network control
err2024-09-03
err0
errOAAI
errMa, Chengdong; Li, Aming; Du, Yali; Dong, Hao; Yang, Yaodong
err分享
err收藏
Self-Supervised MAFENN for Classifying Low-Labeled Distorted Images Over Mobile Fading Channels
err2024-08-01
err0
PREAI
errLi, Yang; Sun, Fanglei; Hu, Jingchen; Liu, Chang; Wu, Fan; Li, Kai; Wen, Ying; Tian, Zheng; Yang, Yaodong; Zhu, Jiangcheng; Chen, Zhifeng; Wang, Jun; Yang, Yang
err分享
err收藏
Integrated transcriptomics and metabolomics analyses of the effects of bagging treatment on carotenoid biosynthesis and regulation of Areca catechu L.
err2024-04-02
err0
errOAAI
errZheng, Xin; Huang, Liyun; Fan, Benyi; Peng, Chunlin; Iqbal, Amjad; Zhang, Yujie; Chen, Hongman; Ye, Jianqiu; Yang, Yaodong
err分享
err收藏
Investigation of regenerative braking for the electric mining truck based on fuzzy control
err2024-01-01
err0
PREAI
errLuo, Denghao; Yang, Weiwei; Wang, Yilin; Han, Yijun; Liu, Qiang; Yang, Yaodong
err分享
err收藏
Large sequence models for sequential decision-making: a survey用于顺序决策的大序列模型: 一项调查
err2023-08-05
err24
errOAAI
errWen, Muning; Lin, Runji; Wang, Hanjing; Yang, Yaodong; Wen, Ying; Mai, Luo; Wang, Jun; Zhang, Haifeng; Zhang, Weinan
err分享
err收藏
Safe multi-agent reinforcement learning for multi-robot control
err2023-06-01
err44
errOAAI
errGu, Shangding; Kuba, Jakub Grudzien; Chen, Yuanpei; Du, Yali; Yang, Long; Knoll, Alois; Yang, Yaodong
err分享
err收藏
Offline Pre-trained Multi-agent Decision Transformer离线预训练的多智能体决策转换器
err2023-03-31
err10
errOAAI
errMeng, Linghui; Wen, Muning; Le, Chenyang; Li, Xiyun; Xing, Dengpeng; Zhang, Weinan; Wen, Ying; Zhang, Haifeng; Wang, Jun; Yang, Yaodong; Xu, Bo
err分享
err收藏
err分享
err收藏