Hugging Face Blog·· 2026-09-03AI Score48
LFM2.5-350M : fine-tuning GRPO en 100 étapes pour de meilleures sorties structurées
Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps
AI Introduction
Liquid AI améliore la conformité aux sorties structurées de LFM2.5-350M via un fine-tuning GRPO avec la bibliothèque TRL.
Source :Hugging Face Blog · huggingface.co