Keras的深度强化学习 它是什么? keras-rl在Python中实现了一些最先进的深度强化学习算法,并与深度学习库无缝集成。 此外, keras-rl可与一起使用。 这意味着评估和使用不同算法很容易。 当然,您可以根据自己的需要扩展keras-rl 。 您可以使用内置的Keras回调和指标,也可以定义自己的回调和指标。 更重要的是,只需扩展一些简单的抽象类,即可轻松实现自己的环境甚至算法。 文档可。 包含什么? 到目前为止,已实现以下算法: 深度Q学习(DQN) , Double DQN 深度确定性策略梯度(DDPG) 连续DQN(CDQN或NAF) 交叉熵方
1
使用PyTorch和Unity ML-Agent进行深度Q网络(DQN)强化学习 一个简单的示例,说明如何使用PyTorch和ML-Agents环境实现基于矢量的DQN。 深度强化学习(DRL)中的Udacity Danaodgree项目 该存储库包含以下与DQN相关的文件: dqn_agent.py-> dqn-agent实现 replay_memory.py-> dqn-agent的重播缓冲区实现 model.py->用于基于向量的DQN学习的示例PyTorch神经网络 train.py->初始化并实施DQN代理的训练过程。 test.py->测试受过训练的DQN代理 根据Udacit
1
强化学习-调查
2021-04-02 14:13:00 511KB 强化学习-调查
Atari Pong中的深度强化学习算法 概括 此应用程序的目标是找出深度Q学习(DQN)在OpenAI环境中对Pong的Atari 1600游戏有多准确和有效。 在DQN之上,测试了对相同算法的其他改进,包括多步DQN,Double DQN和Dueling DQN。 从下图可以看出,基本DQN仅需玩约110场游戏即可达到类似于人的准确性,而经过300场游戏即可达到极高的准确性。 此项目中考虑的DQN改进版本显示出效率和准确性方面的一些改进。 基本DQN:第1集与第216集 环保环境 Atari 1600仿真器由OpenAI制作,您可以在59种不同的游戏上测试您的强化算法。 使用深度强化学习,因为输入是当前帧(210x160x3)的RGB图片。 由于RGB图片的计算量太大,因此变成了灰度。 接下来是将图像缩减采样并将其剪切到可播放区域,该区域的大小为84x84x1。 灰度,下采样和裁剪
2021-03-27 20:32:26 1.3MB Python
1
模仿 在python / Tensorflow中实现选定的逆向强化学习(IRL)算法。 python demo.py 实现的算法 线性逆强化学习(Ng&Russell 2000) 最大熵逆强化学习(Ziebart et al。2008) 最大熵深度逆强化学习(Wulfmeier et al。2015) 已实施MDP和求解器 网格世界2D 网格世界1D 价值迭代 依存关系 python 2.7 cvxopt Tensorflow 0.12.1 matplotlib 线性逆向强化学习 根据Ng和Russell 2000的论文:算法,算法1 $ python linear_irl_
1
梦想控制 注意:检出的代码,该代码同时支持Atari和DMControl环境。 在TensorFlow 2中快速简单地实现Dreamer代理。 如果您认为此代码有用,请在您的论文中参考: @article{hafner2019dreamer, title={Dream to Control: Learning Behaviors by Latent Imagination}, author={Hafner, Danijar and Lillicrap, Timothy and Ba, Jimmy and Norouzi, Mohammad}, journal={arXiv preprint arXiv:1912.01603}, year={2019} } 方法 Dreamer学习了一个可以在紧凑的特征空间中进行预测的世界模型。从想象的特征序列中,它学习了策略和状态值功能
1
, you will not only learn deep reinforcement learning but also become an active contributor to the field. Deep reinforcement learning has the potential to revolutionize the world as we know it. By removing humans from decision-making processes, we set ourselves up to succeed. Humans can't match the stamina and work ethic of a computer;
2021-03-20 21:27:55 32.12MB Deep Reinforcem
1
强化学习MATLAB学习资料
2021-03-15 14:09:56 9.43MB 强化学习 matlab
1
关于强化学习基本概念的介绍,是一个很不错的英文书
2021-02-18 14:08:23 10.68MB 强化学习
1