已选(0)清除
条数/页: 排序方式: |
| 基于深度强化学习的足球智能体球员策略方法研究 学位论文 , 2024 作者: 刘博寅![](/image/person.jpg)
Adobe PDF(11380Kb)  |   收藏  |  浏览/下载:35/0  |  提交时间:2024/07/12 足球 多智能体系统 深度强化学习 互信息 内在激励 预训练 |
| 基于强化学习动作空间精简的时序决策任务算法研究 学位论文 , 2024 作者: 王梓薏![](/image/person.jpg)
Adobe PDF(7273Kb)  |   收藏  |  浏览/下载:37/1  |  提交时间:2024/07/04 时序决策 强化学习 动作空间约简 分层强化学习 动作掩码 |
| 面向多机器人博弈的深度强化学习方法 学位论文 , 2024 作者: 胡光政![](/image/person.jpg)
Adobe PDF(17740Kb)  |   收藏  |  浏览/下载:37/0  |  提交时间:2024/07/04 多智能体深度强化学习 多机器人博弈 极小极大Q学习 值分解 最大熵 |
| 基于强化学习的多无人机协同任务规划技术 学位论文 , 2024 作者: 张梦瑶![](/image/person.jpg)
Adobe PDF(2880Kb)  |   收藏  |  浏览/下载:69/0  |  提交时间:2024/07/04 多无人机协同作战 任务规划 图神经网络 多旅行商问题 强化学习 |
| 基于表征学习的离线强化学习方法研究综述 期刊论文 自动化学报, 2024, 卷号: 50, 期号: 6, 页码: 1104-1128 作者: 王雪松; 王荣荣; 程玉虎
Adobe PDF(3333Kb)  |   收藏  |  浏览/下载:15/10  |  提交时间:2024/07/02 强化学习 离线强化学习 表征学习 历史经验数据 分布偏移 |
| 双足机器人步态生成的研究 学位论文 , 2024 作者: 崔凌志![](/image/person.jpg)
Adobe PDF(7077Kb)  |   收藏  |  浏览/下载:32/1  |  提交时间:2024/07/01 请双足机器人控制 混合零动力 轨迹自由强化学习 周期性步态奖励机制 动态步态优化 模型融合策略 |
| 基于强化学习的视觉内容生成 学位论文 , 2024 作者: 秦子涵![](/image/person.jpg)
Adobe PDF(11517Kb)  |   收藏  |  浏览/下载:32/2  |  提交时间:2024/06/26 图像生成 视频生成 强化学习 |
| 自然语言嵌入的深度强化学习探索方法研究 学位论文 , 2024 作者: 郭洲蕊![](/image/person.jpg)
Adobe PDF(7588Kb)  |   收藏  |  浏览/下载:35/1  |  提交时间:2024/06/26 深度强化学习 自然语言 探索 |
| 数据驱动的可控植物生长环境建模与调控 学位论文 , 2024 作者: 赵晓璇![](/image/person.jpg)
Adobe PDF(4026Kb)  |   收藏  |  浏览/下载:18/0  |  提交时间:2024/06/25 数据驱动 温室气候模型 环境参数 温室气候调控 深度强化学习 |
| Towards Zero-Shot Generalization: Mutual Information-Guided Hierarchical Multi-Agent Coordination 会议论文 , 日本, 2024-6 作者: Zhang Qingyang ; Xu Bo![](/image/person.jpg)
Adobe PDF(8862Kb)  |   收藏  |  浏览/下载:20/7  |  提交时间:2024/06/25 强化学习,分层强化学习 |