a2c-PandaReachDense-v3

This is a trained model of a Reinforcement Learning agent for PandaReachDense-v3 using stable-baselines3. Created for the Hugging Face Deep RL Course.

Evaluation Results

  • Mean Reward: -0.50 +/- 0.10
  • Target Environment: PandaReachDense-v3
  • Library: stable-baselines3
  • Model Architecture: A2C
Downloads last month
10
Video Preview
loading

Evaluation results