Hugging Face publie pytorch_block_sparse pour des modèles de langage plus petits et plus rapides
Hugging Face publie l'extension pytorch_block_sparse.
Hugging Face publie l'extension pytorch_block_sparse.
Le blog Hugging Face détaille les quatre optimisations mémoire du Reformer, un modèle Transformer capable de traiter jusqu'à un demi-million de tokens en une seule passe.
Le blog Hugging Face détaille les méthodes de décodage pour la génération de langage autorégressive avec la bibliothèque transformers.