mradermacher/Hemlock-Apothecary-7B-GRPO-e3-GGUF Reinforcement Learning • 8B • Updated Jul 15 • 398 • 1
mradermacher/Hemlock-Apothecary-7B-GRPO-e3-i1-GGUF Reinforcement Learning • 8B • Updated Jul 15 • 1.05k • 1