返回
Multi-Dueling framework for multi-agent reinforcement learning
DOI:10.1016/j.asoc.2025.113464.png)
摘要
En 中文
• MDF利用分解公式对联合动作值函数进行分解。
• MDF引入V-IGM原则以对状态值函数的值施加约束。
• MDF将一致性约束直接编码到神经网络中,实现严格的IGM一致性。
期刊
IF:
6.6
论文数:
1.4W
被引数:
4.8W
机构
暂无机构信息
引用论文
Multi-agent reinforcement learning as a rehearsal for decentralized planning多智能体强化学习作为分散计划的演练
NEUROCOMPUTING
IF6.5
没有更多内容

