This project focuses on comparing different Reinforcement Learning Algorithms, including monte-carlo, q-learning, lambda q-learning epsilon-greedy variations, etc.
pythonreinforcement-learningmonte-carloopenai-gymq-learningpolicyrl-agentsepsilon-greedydynamic-programmingmarkov-chainsapproximation-algorithmsucb1q-lambdaexploration-exploitationthomson-samplingfrozen-lakemulti-bandit-army
-
Updated
Feb 15, 2022 - Python