验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

多模态人工智能系统... [13]

作者

赵冬斌 [13]

文献类型

期刊论文 [13]

发表日期

语种

出处

IEEE TRANS... [3]

IEEE COMPU... [1]

IEEE TRANS... [1]

IEEE TRANS... [1]

IEEE TRANS... [1]

IEEE Trans... [1]

资助项目

National K... [4]

National N... [2]

National N... [2]

Strategic ... [2]

Youth Inno... [2]

Internatio... [1]

收录类别

导师

资助机构

National K... [4]

National N... [3]

National K... [2]

Strategic ... [2]

Youth Inno... [2]

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

（本次检索基于用户作品认领结果）

浏览/检索结果: 共13条，第1-10条

帮助

限定条件	文献类型：期刊论文作者：赵冬斌第一作者专题：多模态人工智能系统全国重点实验室第一作者的第一单位第一作者单位通讯作者单位

已选(0)清除条数/页：排序方式：
	FM3Q: Factorized Multi-Agent MiniMax Q-Learning for Two-Team Zero-Sum Markov Game 期刊论文 IEEE Transactions on Emerging Topics in Computational Intelligence, 2024, 页码: 1-13 作者: Guangzheng Hu; Yuanheng Zhu; Haoran Li; Dongbin Zhao Adobe PDF(2144Kb) \| 收藏 \| 浏览/下载：44/8 \| 提交时间：2024/06/05 Games Q-learning Task analysis Optimization Convergence Training Nash equilibrium Multi-agent reinforcement learning minimax-Q learning two-team zero-sum Markov games
	NVIF: Neighboring Variational Information Flow for Cooperative Large-Scale Multiagent Reinforcement Learning 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2023, 页码: 13 作者: Chai, Jiajun; Zhu, Yuanheng; Zhao, Dongbin Adobe PDF(2469Kb) \| 收藏 \| 浏览/下载：63/3 \| 提交时间：2023/11/16 Large-scale multiagent neighboring communication reinforcement learning (RL) variational information flow
	Empirical Policy Optimization for n-Player Markov Games 期刊论文 IEEE Transactions on Cybernetics, 2022, 页码: doi={10.1109/TCYB.2022.3179775} 作者: Yuanheng Zhu; Weifan Li; Mengchen Zhao; Jianye Hao; Dongbin Zhao Adobe PDF(1739Kb) \| 收藏 \| 浏览/下载：114/45 \| 提交时间：2023/04/26
	UNMAS: Multiagent Reinforcement Learning for Unshaped Cooperative Scenarios 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2021, 页码: 12 作者: Chai, Jiajun; Li, Weifan; Zhu, Yuanheng; Zhao, Dongbin; Ma, Zhe; Sun, Kewu; Ding, Jishiyu Adobe PDF(3402Kb) \| 收藏 \| 浏览/下载：291/38 \| 提交时间：2022/01/27 Multi-agent systems Training Task analysis Reinforcement learning Sun Learning systems Semantics Centralized training with decentralized execution (CTDE) multiagent reinforcement learning StarCraft II
	Event-Triggered Communication Network With Limited-Bandwidth Constraint for Multi-Agent Reinforcement Learning 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2021, 页码: 13 作者: Hu, Guangzheng; Zhu, Yuanheng; Zhao, Dongbin; Zhao, Mengchen; Hao, Jianye Adobe PDF(4187Kb) \| 收藏 \| 浏览/下载：266/12 \| 提交时间：2022/01/27 Bandwidth Protocols Reinforcement learning Task analysis Optimization Communication networks Multi-agent systems Event trigger limited bandwidth multi-agent communication multi-agent reinforcement learning (MARL)
	Invariant Adaptive Dynamic Programming for Discrete-Time Optimal Control 期刊论文 IEEE TRANSACTIONS ON SYSTEMS MAN CYBERNETICS-SYSTEMS, 2020, 卷号: 50, 期号: 11, 页码: 3959-3971 作者: Zhu, Yuanheng; Zhao, Dongbin; He, Haibo Adobe PDF(2079Kb) \| 收藏 \| 浏览/下载：219/18 \| 提交时间：2021/01/07 Optimal control Discrete-time systems Heuristic algorithms Dynamic programming Convergence Artificial intelligence Nonlinear systems Adaptive dynamic programming discrete-time systems invariant admissibility optimal control policy iteration sum of squares
	Synthesis of Cooperative Adaptive Cruise Control With Feedforward Strategies 期刊论文 IEEE TRANSACTIONS ON VEHICULAR TECHNOLOGY, 2020, 卷号: 69, 期号: 4, 页码: 3615-3627 作者: Zhu, Yuanheng; Zhao, Dongbin; He, Haibo Adobe PDF(2462Kb) \| 收藏 \| 浏览/下载：206/15 \| 提交时间：2020/06/22 Cooperative cruise control H-infinity-norm L-2-gain time-delay system state-space model
	Control-Limited Adaptive Dynamic Programming for Multi-Battery Energy Storage Systems 期刊论文 IEEE TRANSACTIONS ON SMART GRID, 2019, 卷号: 10, 期号: 4, 页码: 4235-4244 作者: Zhu, Yuanheng; Zhao, Dongbin; Li, Xiangjun; Wang, Ding Adobe PDF(973Kb) \| 收藏 \| 浏览/下载：321/16 \| 提交时间：2019/09/30 Microgrid energy storage system multi-battery management system adaptive dynamic programming control-limited optimization
	Clique-based cooperative multiagent reinforcement learning using factor graphs 期刊论文 IEEE/CAA Journal of Automatica Sinica, 2015, 卷号: 3, 期号: 1, 页码: 248-256 作者: Zhang,Zhen; Zhao DB(赵冬斌) 浏览 \| Adobe PDF(707Kb) \| 收藏 \| 浏览/下载：238/96 \| 提交时间：2017/12/30 Reinforcement Learning Factor Graphs
	深度强化学习综述：兼论计算机围棋的发展期刊论文控制理论与应用, 2016, 卷号: 33, 期号: 6, 页码: 701-717 作者: 赵冬斌; 邵坤; 朱圆恒; 李栋; 陈亚冉; 王海涛; 刘德荣; 周彤; 王成红浏览 \| Adobe PDF(2816Kb) \| 收藏 \| 浏览/下载：1810/660 \| 提交时间：2017/09/13 深度强化学习初弈号深度学习强化学习人工智能

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25852
全文量13687
访问量5785727
下载量902136

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495