This repository is a fork of a repository originally created by Lucas Descause. It is the codebase used for my Master's dissertation "Reinforcement Learning with Function Approximation in Continuing Tasks: Discounted Return or Average Reward?" which was also an extension of Luca's work.
pythonreinforcement-learningvisualisationpytorchsarsadata-analysisconvolutional-neural-networksasynchronous-methodsdeep-q-learningempirical-researchreinforcement-learning-environmentsdouble-q-learningstatistical-testingvalue-function-approximationreturn-formulations
-
Updated
Sep 23, 2021 - Jupyter Notebook