mradermacher/Hemlock-Apothecary-7B-GRPO-e3-GGUF Reinforcement Learning • 8B • Updated 5 days ago • 560
mradermacher/Hemlock-Apothecary-7B-GRPO-e3-i1-GGUF Reinforcement Learning • 8B • Updated 4 days ago • 2.84k