Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps Tech · 2026-09-03 18:41:47 Sources Hugging Face Blog: Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps Hugging Face Blog: Up to 3.2x Faster Inference with LFM2.5-DSpark