中国科学院自动化研究所机构知识库(CASIA OpenIR): 检索

浏览/检索结果: 共3条，第1-3条

帮助

已选(0)清除条数/页：排序方式：
	Towards Zero-Shot Generalization: Mutual Information-Guided Hierarchical Multi-Agent Coordination 会议论文 , 日本, 2024-6 作者: Zhang Qingyang; Xu Bo Adobe PDF(8862Kb) \| 收藏 \| 浏览/下载：14/5 \| 提交时间：2024/06/25 强化学习，分层强化学习
	Learn to flap: foil non-parametric path planning via deep reinforcement learning 期刊论文 Journal of Fluid Mechanics, 2024, 卷号: 984, 页码: A9 作者: Wang, Zhipeng; Lin, Runji; Zhao, Zhiyu; Chen, Xu; Guo, Pengming; Yang, Ning; Wang,Zhicheng; Fan, Dixia Adobe PDF(1892Kb) \| 收藏 \| 浏览/下载：38/8 \| 提交时间：2024/06/07
	Token-level Direct Preference Optimization 会议论文 , Vienna, Austria, 2024/7/21-27 作者: Zeng,Yongcheng; Liu,Guoqing; Ma,Weiyu; Yang,Ning; Zhang,Haifeng; Wang,Jun Adobe PDF(883Kb) \| 收藏 \| 浏览/下载：51/16 \| 提交时间：2024/06/05

中国科学院自动化研究所机构知识库