Krishnasri2027/qwen25-coder-1.5b-instruct-fine-tuned-merged Text Generation • 2B • Updated 5 days ago • 654
Krishnasri2027/qwen25-coder-1.5b-instruct-fine-tuned-merged Text Generation • 2B • Updated 5 days ago • 654
view article Article Illustrating Reinforcement Learning from Human Feedback (RLHF) +2 natolambert, LouisCastricato, lvwerra, Dahoas • Dec 9, 2022 • 426
Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition Paper • 2309.15223 • Published Sep 26, 2023 • 23