Hugging Face Blog·· 2024-07-30sélectionAI Score60
Comment réduire la mémoire des Diffusion Transformers avec Quanto et Diffusers
Memory-efficient Diffusion Transformers with Quanto and Diffusers
AI Introduction
Hugging Face présente comment quantifier les pipelines de diffusion basés sur Transformer avec les utilitaires Quanto de la bibliothèque Diffusers.
Raison de la recommandation
L'article détaille les gains de mémoire mesurés sur trois pipelines de diffusion Transformer avec Quanto, avec des tableaux de latence et de qualité.
Source :Hugging Face Blog · huggingface.co