验证码:

换一张

忘记密码？记住我

取消登录

切换中国科技网通行证登录

切换中国科技网通行证登录

取消

中文版 | English

中国科学院自动化研究所机构知识库

Knowledge Commons of Institute of Automation，CAS

登录注册

图片搜索

粘贴图片网址

首页
研究单元&专题
作者
文献类型
知识图谱
新闻&公告

在结果中检索

研究单元&专题

多模态人工智能系统... [35]

复杂系统认知与决策实... [9]

模式识别实验室 [6]

中科院工业视觉智能装... [1]

紫东太初大模型研究中... [1]

模式识别国家重点实验... [1]

作者

文献类型

会议论文 [52]

发表日期

语种

出处

IEEE World... [1]

Internatio... [1]

Proceeding... [1]

Proceeding... [1]

Proceeding... [1]

Proceeding... [1]

资助项目

收录类别

EI [24]

SCI [1]

导师

资助机构

知识图谱

CASIA OpenIR

已提交作品

待认领作品

已认领作品

未提交全文

浏览/检索结果: 共52条，第1-10条

帮助

限定条件

文献类型：会议论文

已选(0)清除条数/页：排序方式：
	An Improved Minimax-Q Algorithm Based on Generalized Policy Iteration to Solve a Chaser-Invader Game 会议论文 , 线上, 2020-5 作者: Liu MS(刘民颂); Zhu YH(朱圆恒); Zhao DB(赵冬斌) Adobe PDF(727Kb) \| 收藏 \| 浏览/下载：16/8 \| 提交时间：2024/07/04
	Self-Modifying State Modeling for Simultaneous Machine Translation 会议论文 , Bangkok, Thailand, August 11–16, 2024 作者: Donglei, Yu; Xiaomian, Kang; Yuchen, Liu; YU, Zhou; Chengqing, Zong Adobe PDF(924Kb) \| 收藏 \| 浏览/下载：23/11 \| 提交时间：2024/06/20
	Filtered Observations for Model-Based Multi-agent Reinforcement Learning 会议论文 , Turin, Italy, 2023.9.18-2023.9.22 作者: Meng Linghui; Xiong Xuantang; Zang Yifan; Zhang Xi; Li Guoqi; Xing Dengpeng; Xu Bo Adobe PDF(841Kb) \| 收藏 \| 浏览/下载：38/16 \| 提交时间：2024/06/11
	Joint caching and transmission in the mobile edge network: An multi-agent learning approach 会议论文 , Madrid, Spain, 2021-12-7 作者: Mi,Qirui; Yang,Ning; Zhang,Haifeng; Zhang,Haijun; Wang,Jun Adobe PDF(1724Kb) \| 收藏 \| 浏览/下载：38/11 \| 提交时间：2024/06/05
	Spiking Adaptive Dynamic Programming with Poisson Process 会议论文 , 中国山东省青岛市, 2021-07-18 作者: Wei QL(魏庆来); Han LY(韩立元); Zhang TL(张铁林) Adobe PDF(2334Kb) \| 收藏 \| 浏览/下载：49/15 \| 提交时间：2024/05/28
	A New Constrained Cost Value Iteration for Optimal Control of Discrete-Time Nonlinear Systems 会议论文 , Beijing, China, 2021.10.22-24 作者: Li, Tao; Wei, Qinglai Adobe PDF(865Kb) \| 收藏 \| 浏览/下载：43/21 \| 提交时间：2024/05/28
	Omnidirectional Drift Control of an Underwater Biomimetic Vehicle-Manipulator System via Reinforcement Learning 会议论文 , Suzhou, China, May 14-16, 2021 作者: Ma, Ruichen; Wang, Yu; Wang, Rui; Wang, Shuo Adobe PDF(855Kb) \| 收藏 \| 浏览/下载：115/40 \| 提交时间：2023/08/02 Omnidirectional Drift Control Undulating Fin Underwater Biomimetic Vehicle-manipulator System (UBVMS) Reinforcement Learning Twin Delayed Deep Deterministic policy gradient (TD3)
	Second-Order Global Attention Networks for Graph Classification and Regression 会议论文 , Beijing, China, August 27-28, 2022 作者: Hu Fenyu; Cui Zeyu; Wu Shu; Liu Qiang; Wu Jinlin; Wang Liang; Tan Tieniu Adobe PDF(69424Kb) \| 收藏 \| 浏览/下载：221/71 \| 提交时间：2023/07/06
	PiCor: Multi-Task Deep Reinforcement Learning with Policy Correction 会议论文 Proceedings of the AAAI Conference on Artificial Intelligence, 美国华盛顿, 2023.02.07 - 2023.02.14 作者: Bai FS(白丰硕); Zhang HM(张鸿铭); Tao TY(陶天阳); Wu ZH(武志亨); Wang YN(王燕娜); Xu B(徐博) Adobe PDF(1663Kb) \| 收藏 \| 浏览/下载：202/47 \| 提交时间：2023/07/05 Reinforcement Learning Algorithms Transfer Domain Adaptation Multi-Task Learning
	Potential Driven Reinforcement Learning for Hard Exploration Tasks 会议论文 , 线上, 2020-4 作者: Zhao EM(赵恩民); Deng SH(邓诗弘); Zang YF(臧一凡); Kang YX(康永欣); Li K(李凯); Xing JL(兴军亮) Adobe PDF(1999Kb) \| 收藏 \| 浏览/下载：118/45 \| 提交时间：2023/06/29

首页
研究单元产出分布图
收录类型分布图
论文引用排行
作者
文献类型
学科分类
关于网站
使用帮助
联系我们

条目量25772
全文量13653
访问量5683491
下载量884850

版权所有 @2018 - 2024 中国科学院自动化研究所 - Powered by CSpace

地址邮编: 北京市海淀区中关村东路95号（100190）
电话: 010－82544495