Simple_Reinforcement_Learning
No description available.
File Explorer
Download Latest Version (.zip)- 1.贪婪算法-checkpoint.ipynb
- 2.递减的贪婪算法-checkpoint.ipynb
- 3.上置信界算法-checkpoint.ipynb
- 4.汤普森采样算法-checkpoint.ipynb
- 1.贪婪算法.ipynb
- 2.递减的贪婪算法.ipynb
- 3.上置信界算法.ipynb
- 4.汤普森采样算法.ipynb
- 1.PPO算法_平衡车-checkpoint.ipynb
- 2.PPO算法_倒立摆-checkpoint.ipynb
- 1.PPO算法_平衡车.ipynb
- 2.PPO算法_倒立摆.ipynb
- 1.DDPG算法-checkpoint.ipynb
- 1.DDPG算法.ipynb
- 1.SAC算法_倒立摆-checkpoint.ipynb
- 2.SAC算法_平衡车-checkpoint.ipynb
- x1.倒立摆-checkpoint.ipynb
- x2.平衡车-checkpoint.ipynb
- 1.SAC算法_倒立摆.ipynb
- 2.SAC算法_平衡车.ipynb
- x1.倒立摆.ipynb
- x2.平衡车.ipynb
- 1.模仿学习-checkpoint.ipynb
- 1.模仿学习_平衡车.ipynb
- 2.模仿学习_倒立摆.ipynb
- 1.离线学习-checkpoint.ipynb
- 1.离线学习.ipynb
- 1.MPC-checkpoint.ipynb
- 1.MPC.ipynb
- 1.MBPO-checkpoint.ipynb
- 1.MBPO-Copy1-checkpoint.ipynb
- 1.MBPO.ipynb
- 1.目标导向的强化学习-checkpoint.ipynb
- 1.目标导向的强化学习.ipynb
- 1.多智能体-checkpoint.ipynb
- 1.多智能体-Copy1-checkpoint.ipynb
- combat.cpython-36.pyc
- 1.多智能体.ipynb
- combat.py
- 1.蒙特卡洛法-checkpoint.ipynb
- 2.贝尔曼方程矩阵-checkpoint.ipynb
- 1.蒙特卡洛法.ipynb
- 2.贝尔曼方程矩阵.ipynb
- 1.策略迭代算法-checkpoint.ipynb
- 2.价值迭代算法-checkpoint.ipynb
- 3.冰湖-checkpoint.ipynb
- 1.策略迭代算法.ipynb
- 2.价值迭代算法.ipynb
- 3.冰湖.ipynb
- 1.Sarsa算法-checkpoint.ipynb
- 2.N步Sarsa算法-checkpoint.ipynb
- 3.QLearning-checkpoint.ipynb
- 1.Sarsa算法.ipynb
- 2.N步Sarsa算法.ipynb
- 3.QLearning.ipynb
- 1.DynaQ-checkpoint.ipynb
- 1.DynaQ.ipynb
- 1.单模型-checkpoint.ipynb
- 2.双模型_平衡车-checkpoint.ipynb
- 3.双模型_倒立摆-checkpoint.ipynb
- 4.DoubleDQN-checkpoint.ipynb
- 5.DuelingDQN-checkpoint.ipynb
- 1.单模型.ipynb
- 2.双模型_平衡车.ipynb
- 3.双模型_倒立摆.ipynb
- 4.DoubleDQN.ipynb
- 5.DuelingDQN.ipynb
- 1.Reinforce算法-checkpoint.ipynb
- 2.Actor_Critic算法-checkpoint.ipynb
- 3.TRPO算法_未完成-checkpoint.ipynb
- 4.PPO算法-checkpoint.ipynb
- 1.Reinforce算法.ipynb
- 1.Actor_Critic算法-checkpoint.ipynb
- 1.Actor_Critic算法.ipynb
- 1.gym-checkpoint.ipynb
- 1.gym.ipynb
- README.md
// repository documentation
Was this content helpful?
(0 ratings)
