未登录Mitigating Distribution Shift in Offline RL-Based Recommender Systems with a Q-Learning Regularization Decision Transformer缓解基于离线强化学习的推荐系统中的分布偏移:带有Q学习正则化的决策转换器
Zhou, Yu; Guo, Xinyu; Jiang, Yuanbo; Fang, Jiaxuan; Wang, Jin-Qiang; Zhi, Peng; Liu, Gang; Zhou, Rui; Li, Ling-Huey; Liu, Chuanyi; Zhou, Qingguo; Li, Kuan-Ching
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏
分享
收藏