PPO Agent Playing LunarLander-v2

This is a PPO agent trained from scratch using PyTorch.

Evaluation

Mean reward: 35.32 +/- 57.58

Evaluation episodes: 10

Files

  • model.pt — trained PPO model weights
  • replay.mp4 — replay video
  • results.json — evaluation results
  • hyperparameters.json — training configuration
Downloads last month
45
Video Preview
loading

Evaluation results