code-critic-model/Qwen3-8B-Critic-SFT-Detailed-Prompt Text Generation • 1B • Updated 23 days ago • 428
mradermacher/Qwable-9B-Claude-Fable-5-StraTA-GGUF Reinforcement Learning • 9B • Updated Jun 29 • 759 • 2
mradermacher/Qwable-9B-Claude-Fable-5-StraTA-i1-GGUF Reinforcement Learning • 9B • Updated Jun 29 • 1.27k • 1
flammafex/Qwen3-4B-High-Level-Critic-SFT-DPO-GGUF Text Generation • 4B • Updated about 13 hours ago • 161