mradermacher/Hemlock-Apothecary-7B-GRPO-e3-GGUF Reinforcement Learning • 8B • Updated 28 days ago • 598 • 1
mradermacher/Hemlock2-Coder-7B-GRPO-GGUF Reinforcement Learning • 8B • Updated 28 days ago • 1.17k • 1
mradermacher/Hemlock-Apothecary-7B-GRPO-e3-i1-GGUF Reinforcement Learning • 8B • Updated 28 days ago • 2.94k • 1
mradermacher/Hemlock2-Coder-7B-GRPO-i1-GGUF Reinforcement Learning • 8B • Updated 28 days ago • 1.98k • 1
mradermacher/NAS-PO-GRPO-Qwen3-VL-8B-GGUF Reinforcement Learning • 8B • Updated 19 days ago • 425 • 1