对深度强化学习的基本操作的程序。
2021-02-15 15:09:12 14.03MB 深度学习
1
关于强化学习的基础材料
2021-02-04 15:09:33 652KB 强化学习
1
模仿学习 此仓库包含一些强化学习算法的简单PyTorch实现: 优势演员评论家(A2C) 的同步变体 近端策略优化(PPO)-最受欢迎的RL算法 , ,, 策略上最大后验策略优化(V-MPO)-DeepMind在其上次工作中使用的算法 (尚不起作用...) 行为克隆(BC)-一种将某些专家行为克隆到新策略中的简单技术 每种算法都支持向量/图像/字典观察空间和离散/连续动作空间。 为什么回购被称为“模仿学习”? 当我开始这个项目并进行回购时,我认为模仿学习将是我的主要重点,并且无模型方法仅在开始时用于培训“专家”。 但是,PPO实施(及其技巧)似乎比我预期的花费了更多时间。 结果,现在大多数代码与PPO有关,但是我仍然对模仿学习感兴趣,并打算添加一些相关算法。 当前功能 目前,此仓库包含一些无模型的基于策略的算法实现:A2C,PPO,V-MPO和BC。 每种算法都支持离散(分类,伯努利,GumbelSoftmax)和连续(贝塔,正态,tanh(正态))策略分布以及矢量或图像观察环境。 Beta和tanh(Normal)在我的实验中效果最好(在BipedalWalker和Huma
1
awesome-CARLA::backhand_index_pointing_right:CARLA资源,例如教程,博客,代码等https://github.comcarla-simulatorcarla
2021-02-02 12:06:22 82KB awesome simulator reinforcement-learning code
1
awesome-game-ai:多智能体强化学习的Awesome Game AI资料
2021-02-01 14:37:52 6KB awesome reinforcement-learning ai multi-agent
1
Deep Reinforcement Learning, Frontiers of Artificial Intelligence, 2019
2020-01-10 03:12:49 15.91MB 强化学习 深度学习 deep learning
1
Reinforcement Learning: An Introduction Small book cover Richard S. Sutton and Andrew G. Barto Second Edition (see here for the first edition) MIT Press, Cambridge, MA, 2018
2020-01-08 03:09:23 84.44MB 强化学习 机器学习
1
应用Python进行强化学习实践,Hands-On Reinforcement Learning - Sudharsan Ravichandiran(带书签PDF+代码),434页资料。
2020-01-03 11:36:05 55.92MB python 强化学习 代码 带书签PDF
1
Python强化学习实战:应用OpenAI Gym和TensorFlow精通强化学习和深度强化学习 英文原版含代码 Hands-On Reinforcement Learning with Python: Master reinforcement and deep reinforcement learning using OpenAI Gym and TensorFlow Sudharsan Ravichandiran
2020-01-03 11:31:02 56.06MB 强化学习 深度学习 Gym Python
1
强化学习在自然语言处理中的应用,黄民烈老师的PPT文档!
2020-01-03 11:20:28 9.27MB 强化学习 NLP
1