John Huang
jyellow
AI & ML interests
RL
Organizations
None yet
models 10
jyellow/peft-starcoder-lora-a100
Updated
jyellow/Reinforce-Pixelcopter-PLE-v0
Updated
jyellow/Reinforce-1
Reinforcement Learning • Updated
jyellow/dqn-SpaceInvadersNoFrameskip-v4
Reinforcement Learning • Updated • 1
jyellow/q-Taxi-v3
Reinforcement Learning • Updated
jyellow/q-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning • Updated
jyellow/ppo-Huggy
Reinforcement Learning • Updated • 89
jyellow/ppo-LunarLander-v2
Reinforcement Learning • Updated • 1
jyellow/NeuralHermes-Llama-3.2-3B
Text Generation • 3B • Updated • 9
jyellow/tinyllama-fine-tuning-sft-lora
Text Generation • 1B • Updated • 6
datasets 0
None public yet