CASIA OpenIR

浏览/检索结果: 共277条,第1-10条 帮助

已选(0)清除 条数/页:   排序方式:
Interpretability of Neural Networks Based on Game-theoretic Interactions 期刊论文
Machine Intelligence Research, 2024, 卷号: 21, 期号: 4, 页码: 718-739
作者:  Huilin Zhou;   Jie Ren;   Huiqi Deng;   Xu Cheng;  Jinpeng Zhang;   Quanshi Zhang
Adobe PDF(2984Kb)  |  收藏  |  浏览/下载:13/3  |  提交时间:2024/07/18
Model interpretability and transparency  explainable AI  game theory  interaction  deep learning  
Lazy Agents: A New Perspective on Solving Sparse Reward Problem in Multi-agent Reinforcement Learning 期刊
创刊日期: 2018,
主办者:  Liu BY(刘博寅)
Adobe PDF(5797Kb)  |  收藏  |  浏览/下载:23/5  |  提交时间:2024/07/12
QFuture: Learning Future Expectation Cognition in Multi-Agent Reinforcement Learning 期刊论文
IEEE Transactions on Cognitive and Developmental Systems, 2024, 页码: 12
作者:  Liu BY(刘博寅)
Adobe PDF(6675Kb)  |  收藏  |  浏览/下载:20/2  |  提交时间:2024/07/12
基于深度强化学习的足球智能体球员策略方法研究 学位论文
, 2024
作者:  刘博寅
Adobe PDF(11380Kb)  |  收藏  |  浏览/下载:46/0  |  提交时间:2024/07/12
足球  多智能体系统  深度强化学习  互信息  内在激励  预训练  
Offline Hierarchical Reinforcement Learning: Enable Large-Scale Training in HRL 会议论文
, Nanjing, 2023-11-27
作者:  Yuqiao Wu;  Haifeng Zhang;  Jun Wang
Adobe PDF(1339Kb)  |  收藏  |  浏览/下载:21/5  |  提交时间:2024/07/12
NeuronsMAE: A Novel Multi-Agent Reinforcement Learning Environment for Cooperative and Competitive Multi-Robot Tasks 会议论文
, Queensland, Australia, 2023-6
作者:  Hu GZ(胡光政);  Li HR(李浩然);  Liu SS(刘莎莎);  Zhu YH(朱圆恒);  Zhao DB(赵冬斌)
Adobe PDF(2785Kb)  |  收藏  |  浏览/下载:33/9  |  提交时间:2024/07/04
自适应分布式聚合博弈广义纳什均衡算法 期刊论文
自动化学报, 2024, 卷号: 50, 期号: 6, 页码: 1210-1220
作者:  时侠圣;  任璐;  孙长银
Adobe PDF(1595Kb)  |  收藏  |  浏览/下载:20/10  |  提交时间:2024/07/02
聚合博弈  自适应  比例积分  梯度跟踪  一般线性多智能体系统  
A Brain-inspired Theory of Collective Mind Model for Efficient Social Cooperation 期刊论文
IEEE Transactions on Artificial Intelligence, 2024, 页码: 无
作者:  Zhao,Zhuoya;  Zhao,Feifei;  Wang,Shiwen;  Sun,Yinqian;  Zeng,Yi
Adobe PDF(2270Kb)  |  收藏  |  浏览/下载:25/16  |  提交时间:2024/06/25
基于视觉表征的深度强化学习方法 学位论文
, 2024
作者:  刘民颂
Adobe PDF(10778Kb)  |  收藏  |  浏览/下载:46/4  |  提交时间:2024/06/22
深度强化学习,视觉表征学习,自监督学习,状态抽象,Transformer神经网络  
Physics-Inspired Spatial-Temporal Graph Neural Networks for Predicting Industrial Chain Resilience 期刊论文
Journal of Machine Learning Research, 2024, 卷号: 4, 期号: 23, 页码: 1-23
作者:  Wang BC(王必成);  Wang JP(王军平)
Adobe PDF(2342Kb)  |  收藏  |  浏览/下载:75/22  |  提交时间:2024/06/12