Aller au contenu
Hugging Face Blog·· 2024-07-10AI Score38

TRL prend en charge l'optimisation directe des préférences (DPO) pour les modèles vision-langage

Preference Optimization for Vision Language Models

AI Introduction

La bibliothèque TRL prend désormais en charge l'optimisation directe des préférences (DPO) pour les modèles vision-langage (VLM).

Source :Hugging Face Blog · huggingface.co