PPO Agent Playing LunarLander-v2
This is a PPO agent trained from scratch using PyTorch.
Evaluation
Mean reward: 35.32 +/- 57.58
Evaluation episodes: 10
Files
model.pt— trained PPO model weightsreplay.mp4— replay videoresults.json— evaluation resultshyperparameters.json— training configuration
- Downloads last month
- 45
Evaluation results
- mean_reward on LunarLander-v2self-reported35.32 +/- 57.58