验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

多模态人工智能系统全... [2]

学术期刊 [1]

复杂系统认知与决策实... [1]

模式识别实验室 [1]

作者

文献类型

期刊论文 [3]

会议论文 [2]

学位论文 [1]

发表日期

2022 [6]

语种

出处

IEEE TRANS... [1]

IEEE Trans... [1]

IEEE/CAA J... [1]

资助项目

National K... [1]

National K... [1]

收录类别

EI [1]

SCI [1]

导师

资助机构

National K... [1]

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

浏览/检索结果: 共6条，第1-6条

帮助

限定条件

发表日期：2022

已选(0)清除条数/页：排序方式：
	Learning in bi-level markov games 会议论文 , Padua, Italy, 2022.7.18-2022.7.23 作者: Meng Linghui; Ruan Jingqing; Xing Dengpeng; Xu Bo Adobe PDF(1450Kb) \| 收藏 \| 浏览/下载：54/23 \| 提交时间：2024/06/11
	Second-Order Global Attention Networks for Graph Classification and Regression 会议论文 , Beijing, China, August 27-28, 2022 作者: Hu Fenyu; Cui Zeyu; Wu Shu; Liu Qiang; Wu Jinlin; Wang Liang; Tan Tieniu Adobe PDF(69424Kb) \| 收藏 \| 浏览/下载：238/77 \| 提交时间：2023/07/06
	Empirical Policy Optimization for n-Player Markov Games 期刊论文 IEEE Transactions on Cybernetics, 2022, 页码: doi={10.1109/TCYB.2022.3179775} 作者: Yuanheng Zhu; Weifan Li; Mengchen Zhao; Jianye Hao; Dongbin Zhao Adobe PDF(1739Kb) \| 收藏 \| 浏览/下载：118/49 \| 提交时间：2023/04/26
	Efficient Exploration for Multi-Agent Reinforcement Learning via Transferable Successor Features 期刊论文 IEEE/CAA Journal of Automatica Sinica, 2022, 卷号: 9, 期号: 9, 页码: 1673-1686 作者: Wenzhang Liu; Lu Dong; Dan Niu; Changyin Sun Adobe PDF(5554Kb) \| 收藏 \| 浏览/下载：184/79 \| 提交时间：2022/08/19 Knowledge transfer multi-agent systems reinforcement learning successor features
	基于深度强化学习的群体协同决策方法研究学位论文工学博士, 中国科学院自动化研究所: 中国科学院自动化研究所, 2022 作者: 吴士广 Adobe PDF(14260Kb) \| 收藏 \| 浏览/下载：459/25 \| 提交时间：2022/06/15 群体系统协同决策深度强化学习多智能体强化学习图注意力网络
	Online Minimax Q Network Learning for Two-Player Zero-Sum Markov Games 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2022, 卷号: 33, 期号: 3, 页码: 1228-1241 作者: Zhu, Yuanheng; Zhao, Dongbin Adobe PDF(2838Kb) \| 收藏 \| 浏览/下载：260/16 \| 提交时间：2022/06/10 Games Nash equilibrium Mathematical model Markov processes Convergence Dynamic programming Training Deep reinforcement learning (DRL) generalized policy iteration (GPI) Markov game (MG) Nash equilibrium Q network zero sum

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25867
全文量13705
访问量5906048
下载量931555

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495