A2C Agent playing PandaReachDense-v3

This is a trained model of an A2C agent playing PandaReachDense-v3 using the stable-baselines3 library and Panda-Gym.

Evaluation Results

  • Mean Reward: -1.37 +/- 0.15
  • Episodes Evaluated: 10
  • Deterministic: True

Usage (with Stable-baselines3)

import gymnasium as gym
import panda_gym
from stable_baselines3 import A2C
from stable_baselines3.common.vec_env import DummyVecEnv, VecNormalize
from huggingface_sb3 import load_from_hub

# Load model and normalization statistics
repo_id = "Nikhitha123/a2c-PandaReachDense-v3"
checkpoint = load_from_hub(repo_id, "a2c-PandaReachDense-v3.zip")
Downloads last month
-
Video Preview
loading

Evaluation results