验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

学术期刊 [15]

复杂系统认知与决策实... [6]

多模态人工智能系统全... [4]

中科院工业视觉智能装... [1]

综合信息系统研究中心 [1]

作者

文献类型

期刊论文 [23]

会议论文 [4]

学位论文 [3]

发表日期

2023 [30]

语种

出处

IEEE/CAA ... [10]

Machine In... [4]

自动化学报 [3]

Computatio... [1]

Connection... [1]

FRONTIERS ... [1]

资助项目

National D... [1]

National D... [1]

National K... [1]

National N... [1]

National N... [1]

New Genera... [1]

收录类别

EI [4]

SCI [4]

导师

资助机构

National N... [2]

National D... [1]

National D... [1]

National K... [1]

New Genera... [1]

Science an... [1]

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

浏览/检索结果: 共30条，第1-10条

帮助

限定条件

发表日期：2023

已选(0)清除条数/页：排序方式：
	Latent Landmark Graph for Efficient Exploration-Exploitation Balance in Hierarchical Reinforcement Learning 期刊论文 Machine Intelligence Research, 2023, 页码: 158 作者: Zhang Qingyang; Zhang Hongming; Xing Dengpeng; Bo Xu Adobe PDF(9639Kb) \| 收藏 \| 浏览/下载：7/5 \| 提交时间：2024/06/25
	LEGO: A Multi-agent Collaborative Framework with Role-playing and Iterative Feedback for Causality Explanation Generation 会议论文 , Singapore, 2023-12 作者: Zhitao He; Pengfei Cao; Yubo Chen; Kang Liu; Jun Zhao Adobe PDF(1153Kb) \| 收藏 \| 浏览/下载：4/2 \| 提交时间：2024/06/25
	M3: Modularization for Multi-task and Multi-agent Offline Pre-training 会议论文 , London, United Kingdom, 2023.5.29-2023.6.2 作者: Meng Linghui; Ruan Jingqing; Xiong Xuantang; Li Xiyun; Zhang Xi; Xing Dengpeng; Xu Bo Adobe PDF(1302Kb) \| 收藏 \| 浏览/下载：18/4 \| 提交时间：2024/06/11
	Resizemix: Mixing data with preserved object information and true labels 期刊论文 Computational Visual Media, 2023, 页码: -- 作者: Jie Qin; Jiemin Fang; Qian Zhang; Wenyu Liu; Xingang Wang; Xinggang Wang Adobe PDF(9105Kb) \| 收藏 \| 浏览/下载：12/4 \| 提交时间：2024/06/04
	Reward Estimation with Scheduled Knowledge Distillation for Dialogue Policy Learning 期刊论文 Connection Science, 2023, 卷号: 35, 期号: 1, 页码: 2174078 作者: Qiu JY(邱俊彦); Haidong Zhang; Yiping Yang Adobe PDF(831Kb) \| 收藏 \| 浏览/下载：28/10 \| 提交时间：2024/05/29 reinforcement learning dialogue policy learning curriculum learning knowledge distillation
	Explicitly Learning Policy Under Partial Observability in Multiagent Reinforcement Learning 会议论文 , Queensland, Australia, 2023-6 作者: Yang, Chen; Yang, Guangkai; Chen, Hao; Zhang, Junge Adobe PDF(3027Kb) \| 收藏 \| 浏览/下载：38/15 \| 提交时间：2024/05/29
	Constrained-cost adaptive dynamic programming for optimal control of discrete-time nonlinear systems 期刊论文 IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2023, 卷号: 35, 期号: 3, 页码: 3251 - 3264 作者: Wei, Qinglai; Li, Tao Adobe PDF(8471Kb) \| 收藏 \| 浏览/下载：34/12 \| 提交时间：2024/05/28 Adaptive dynamic programming approximate dynamic programming constrained cost optimal control reinforcement learning
	HAVEN: Hierarchical Cooperative Multi-Agent Reinforcement Learning with Dual Coordination Mechanism 会议论文 , Washington, DC, USA, February 7-14, 2023 作者: Zhiwei Xu; Yunpeng Bai; Bin Zhang; Dapeng Li; Guoliang Fan Adobe PDF(3345Kb) \| 收藏 \| 浏览/下载：23/6 \| 提交时间：2024/05/28
	未知非线性零和博弈最优跟踪的事件触发控制设计期刊论文自动化学报, 2023, 卷号: 49, 期号: 1, 页码: 91-101 作者: 王鼎; 胡凌治; 赵明明; 哈明鸣; 乔俊飞 Adobe PDF(1996Kb) \| 收藏 \| 浏览/下载：38/15 \| 提交时间：2024/05/09 自适应评判设计事件触发控制神经网络最优跟踪控制稳定性分析零和博弈
	多智能体博弈、学习与控制期刊论文自动化学报, 2023, 卷号: 49, 期号: 3, 页码: 580-613 作者: 王龙; 黄锋 Adobe PDF(2088Kb) \| 收藏 \| 浏览/下载：18/5 \| 提交时间：2024/05/09 博弈论多智能体学习控制论强化学习人工智能

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25439
全文量13499
访问量5507577
下载量848602

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495