Hugging Face Blog·· 2024-07-10AI Score38
TRL prend en charge l'optimisation directe des préférences (DPO) pour les modèles vision-langage
Preference Optimization for Vision Language Models
AI Introduction
La bibliothèque TRL prend désormais en charge l'optimisation directe des préférences (DPO) pour les modèles vision-langage (VLM).
Source :Hugging Face Blog · huggingface.co