Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
KavyaChinta05
/
reinforce-CartPole-v1
Like
0
Reinforcement Learning
PyTorch
policy-gradient
reinforce
CartPole-v1
Eval Results (legacy)
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
REINFORCE Agent playing CartPole-v1
Environment
Evaluation
REINFORCE Agent playing CartPole-v1
This model implements the REINFORCE policy-gradient algorithm using PyTorch.
Environment
CartPole-v1
Evaluation
Mean reward: 424.41
Standard deviation: 47.23
Certification score: 377.18
Evaluation episodes: 100
Downloads last month
-
Downloads are not tracked for this model.
How to track
Video Preview
Reinforcement Learning
loading
Evaluation results
mean_reward
on CartPole-v1
self-reported
424.41 +/- 47.23