中国科学院自动化研究所机构知识库(CASIA OpenIR): 检索

浏览/检索结果: 共4条，第1-4条

帮助

已选(0)清除条数/页：排序方式：
	Dual Self-Awareness Value Decomposition Framework without Individual Global Max for Cooperative MARL 会议论文 , New Orleans, LA, USA, December 10-16, 2023 作者: Zhiwei Xu; Bin Zhang; Dapeng Li; Guangchong Zhou; Zeren Zhang; Guoliang Fan Adobe PDF(8700Kb) \| 收藏 \| 浏览/下载：16/3 \| 提交时间：2024/05/28
	Consensus Learning for Cooperative Multi-Agent Reinforcement Learning 会议论文 , Washington, DC, USA, February 7-14, 2023 作者: Zhiwei Xu; Bin Zhang; Dapeng Li; Zeren Zhang; Guangchong Zhou; Hao Chen; Guoliang Fan Adobe PDF(4141Kb) \| 收藏 \| 浏览/下载：14/4 \| 提交时间：2024/05/28
	HAVEN: Hierarchical Cooperative Multi-Agent Reinforcement Learning with Dual Coordination Mechanism 会议论文 , Washington, DC, USA, February 7-14, 2023 作者: Zhiwei Xu; Yunpeng Bai; Bin Zhang; Dapeng Li; Guoliang Fan Adobe PDF(3345Kb) \| 收藏 \| 浏览/下载：16/4 \| 提交时间：2024/05/28
	基于噪声对比估计的权重自适应对抗生成式模仿学习期刊论文模式识别与人工智能, 2023, 卷号: 36, 期号: 4, 页码: 300-312 作者: 关伟凡; 张希 Adobe PDF(1849Kb) \| 收藏 \| 浏览/下载：129/44 \| 提交时间：2023/06/29 强化学习模仿学习噪声对比估计自适应权重

中国科学院自动化研究所机构知识库