Aller au contenu
Hugging Face Blog·· 2024-07-30sélectionAI Score60

Comment réduire la mémoire des Diffusion Transformers avec Quanto et Diffusers

Memory-efficient Diffusion Transformers with Quanto and Diffusers

AI Introduction

Hugging Face présente comment quantifier les pipelines de diffusion basés sur Transformer avec les utilitaires Quanto de la bibliothèque Diffusers.

Raison de la recommandation

L'article détaille les gains de mémoire mesurés sur trois pipelines de diffusion Transformer avec Quanto, avec des tableaux de latence et de qualité.

Source :Hugging Face Blog · huggingface.co