Pankaj Rawat
pankajr141
·
AI & ML interests
None yet
Organizations
None yet
huggingface_deeprl (course)
Deep RL course - models. The github location for code can be found at https://github.com/pankajr141/courses/tree/main/Deep%20RL%20-%20Hugging%20Face
-
pankajr141/huggingface_deeprl_unit1_LunarLander-v2
Reinforcement Learning • Updated • 3 -
pankajr141/huggingface_deeprl_unit1_bonus_ppo-Huggy
Reinforcement Learning • Updated • 63 -
pankajr141/huggingface_deeprl_unit2_-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning • Updated -
pankajr141/huggingface_deeprl_unit2_Taxi-v3
Reinforcement Learning • Updated
Models LLM and Embedding
huggingface_deeprl (course)
Deep RL course - models. The github location for code can be found at https://github.com/pankajr141/courses/tree/main/Deep%20RL%20-%20Hugging%20Face
-
pankajr141/huggingface_deeprl_unit1_LunarLander-v2
Reinforcement Learning • Updated • 3 -
pankajr141/huggingface_deeprl_unit1_bonus_ppo-Huggy
Reinforcement Learning • Updated • 63 -
pankajr141/huggingface_deeprl_unit2_-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning • Updated -
pankajr141/huggingface_deeprl_unit2_Taxi-v3
Reinforcement Learning • Updated
models 8
pankajr141/llm_bhasa_v1
Text Generation • 0.2B • Updated • 7
pankajr141/huggingface_deeprl_unit4_Pixelcopter-PLE-v0
Reinforcement Learning • Updated
pankajr141/huggingface_deeprl_unit4_CartPole-v1
Reinforcement Learning • Updated
pankajr141/huggingface_deeprl_unit3_SpaceInvadersNoFrameskip-v4
Reinforcement Learning • Updated
pankajr141/huggingface_deeprl_unit2_Taxi-v3
Reinforcement Learning • Updated
pankajr141/huggingface_deeprl_unit2_-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning • Updated
pankajr141/huggingface_deeprl_unit1_bonus_ppo-Huggy
Reinforcement Learning • Updated • 63
pankajr141/huggingface_deeprl_unit1_LunarLander-v2
Reinforcement Learning • Updated • 3
datasets 0
None public yet