High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

a2c actor-critic advantage-actor-critic ale atari deep-learning deep-reinforcement-learning gym machine-learning phasic-policy-gradient ppo proximal-policy-optimization python pytorch reinforcement-learning wandb
2 Open Issues Need Help Last updated: Aug 17, 2026

Open Issues Need Help

View All on GitHub
help wanted require expertise

High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

Python
#a2c#actor-critic#advantage-actor-critic#ale#atari#deep-learning#deep-reinforcement-learning#gym#machine-learning#phasic-policy-gradient#ppo#proximal-policy-optimization#python#pytorch#reinforcement-learning#wandb
Adding unit tests 4 months ago
help wanted

High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

Python
#a2c#actor-critic#advantage-actor-critic#ale#atari#deep-learning#deep-reinforcement-learning#gym#machine-learning#phasic-policy-gradient#ppo#proximal-policy-optimization#python#pytorch#reinforcement-learning#wandb