Aller au contenu
Hugging Face Blog·· 2026-09-03AI Score48

LFM2.5-350M : fine-tuning GRPO en 100 étapes pour de meilleures sorties structurées

Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps

AI Introduction

Liquid AI améliore la conformité aux sorties structurées de LFM2.5-350M via un fine-tuning GRPO avec la bibliothèque TRL.

Source :Hugging Face Blog · huggingface.co