local-inference-lab/Qwen3.8-Flash-Next-NVFP4 Image-Text-to-Text • 93B • Updated 10 days ago • 28.9k • 33
view article Article Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps +1 iamleonie, burtenshaw, sergiopaniego • 24 days ago • 138