验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

多模态人工智能系统全... [2]

复杂系统认知与决策实... [1]

模式识别实验室 [1]

作者

文献类型

学位论文 [4]

期刊论文 [2]

会议论文 [1]

发表日期

2022 [7]

语种

出处

IEEE TRANS... [1]

IEEE Trans... [1]

资助项目

National K... [1]

National K... [1]

收录类别

EI [1]

SCI [1]

导师

资助机构

National K... [1]

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

浏览/检索结果: 共7条，第1-7条

帮助

限定条件

发表日期：2022

已选(0)清除条数/页：排序方式：
	A Cooperation Graph Approach for Multiagent Sparse Reward Reinforcement Learning 会议论文 , Padua, Italy, 2022年07月作者: Qingxu Fu; Tenghai Qiu; Zhiqiang Pu; Jianqiang Yi; Wanmai Yuan Adobe PDF(2650Kb) \| 收藏 \| 浏览/下载：38/12 \| 提交时间：2024/06/05
	Empirical Policy Optimization for n-Player Markov Games 期刊论文 IEEE Transactions on Cybernetics, 2022, 页码: doi={10.1109/TCYB.2022.3179775} 作者: Yuanheng Zhu; Weifan Li; Mengchen Zhao; Jianye Hao; Dongbin Zhao Adobe PDF(1739Kb) \| 收藏 \| 浏览/下载：111/44 \| 提交时间：2023/04/26
	知识与数据协同驱动的异质图像表示与合成学位论文 , 中国科学院自动化研究所: 中国科学院大学, 2022 作者: 骆曼迪 Adobe PDF(10423Kb) \| 收藏 \| 浏览/下载：337/15 \| 提交时间：2022/08/08 知识与数据协同驱动异质图像表示异质图像合成异质图像转换生成对抗网络信息瓶颈
	基于异质图像知识的视觉感知方法研究学位论文 , 中国科学院自动化研究所: 中国科学院自动化研究所, 2022 作者: 严岚 Adobe PDF(13252Kb) \| 收藏 \| 浏览/下载：249/11 \| 提交时间：2022/06/23 异质图像计算机视觉深度学习生成对抗网络
	基于关系网络的多智能体协同分层决策技术学位论文工程硕士, 中国科学院自动化研究所: 中国科学院自动化研究所, 2022 作者: 张朋朋 Adobe PDF(9752Kb) \| 收藏 \| 浏览/下载：236/12 \| 提交时间：2022/06/13 多智能体协同关系网络分层热力图可解释性
	基于深度强化学习的扁平类物体预抓取操作的研究学位论文工学硕士, 中国科学院自动化研究所: 中国科学院自动化研究所, 2022 作者: 吴家汐 Adobe PDF(26650Kb) \| 收藏 \| 浏览/下载：215/10 \| 提交时间：2022/06/13 预抓取操作深度强化学习课程学习
	Online Minimax Q Network Learning for Two-Player Zero-Sum Markov Games 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2022, 卷号: 33, 期号: 3, 页码: 1228-1241 作者: Zhu, Yuanheng; Zhao, Dongbin Adobe PDF(2838Kb) \| 收藏 \| 浏览/下载：249/12 \| 提交时间：2022/06/10 Games Nash equilibrium Mathematical model Markov processes Convergence Dynamic programming Training Deep reinforcement learning (DRL) generalized policy iteration (GPI) Markov game (MG) Nash equilibrium Q network zero sum

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25785
全文量13666
访问量5713189
下载量889298

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495