besaleli/t5-regex-summarization
Updated • 11
• 1
besa2001/ppo-LunarLander-v2
Reinforcement Learning
• Updated • 11
besa2001/q-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning
• Updated Reinforcement Learning
• Updated besa2001/dqn-SpaceInvadersNoFrameskip-v4
Reinforcement Learning
• Updated • 17
besa2001/Reinforce-cartpole
Reinforcement Learning
• Updated besa2001/Reinforce-CartPole-v1
Reinforcement Learning
• Updated besa2001/Reinforce-Pixelcopter-PLE-v0
Reinforcement Learning
• Updated besa2001/ppo-SnowballTarget
Reinforcement Learning
• Updated • 32
besa2001/PyramidsTraining
Reinforcement Learning
• Updated • 40
besa2001/a2c-AntBulletEnv-v0
Reinforcement Learning
• Updated • 11
besa2001/a2c-PandaReachDense-v2
Reinforcement Learning
• Updated • 14
Reinforcement Learning
• Updated • 79
Reinforcement Learning
• Updated besa2001/rl_course_vizdoom_health_gathering_supreme
Reinforcement Learning
• Updated besa2001/rl_course_vizdoom_doom_deathmatch_bots
Reinforcement Learning
• Updated besartshyti/falcon-7b-qlora-chat-support-bot-faq
Updated
besartshyti/sd_martin_valen-model-v1-2_400_demo
Updated
besartshyti/sd_aiconos-model-v1-2_400
Updated
besartshyti/mixtral-moe-lora-instruct-shapeskeare
Updated
besartshyti/gemma-2b-peft
Updated
ripaaiii/fine-tune-C1-revised-lr6-boxkecil20_besar5
Image-Text-to-Text
• 0.6B • Updated • 7
ripaaiii/fine-tune-C1-stage1_5epoch_besar
Image-Text-to-Text
• 0.6B • Updated • 6
ripaaiii/fine-tune-C1-stage1_16epoch_besar
Image-Text-to-Text
• 0.6B • Updated • 8