Aller au contenu
Hugging Face Blog·· 2021-11-19AI Score22

Accélérer le fine-tuning distribué PyTorch avec les technologies Intel

Accelerating PyTorch distributed fine-tuning with Intel technologies

AI Introduction

Intel détaille comment accélérer le fine-tuning distribué de PyTorch sur des clusters de serveurs Intel Xeon Scalable (architecture Ice Lake) via l'Intel extension for PyTorch et oneCCL. Le tutoriel fine-tune un modèle BERT sur le dataset MRPC (5 800 paires de phrases du benchmark GLUE), en comparant un job sur un seul serveur puis sur 2 et 4 serveurs pour mesurer le speed-up. Les instances utilisées sont des Amazon EC2 c6i.16xlarge (64 vCPUs, 128 Go de RAM, réseau 25 Gbit/s), avec des équivalents disponibles chez Azure et Google Cloud.

Source :Hugging Face Blog · huggingface.co