Aller au contenu
Hugging Face Blog·· 2022-02-11AI Score22

Fine-tuner ViT pour la classification d'images avec 🤗 Transformers

Fine-Tune ViT for Image Classification with 🤗 Transformers

AI Introduction

Hugging Face détaille le fine-tuning du Vision Transformer (ViT) pour la classification d'images via les bibliothèques 🤗 datasets et transformers. Le tutoriel s'appuie sur le modèle google/vit-base-patch16-224-in21k et le jeu de données beans (3 classes : angular_leaf_spot, bean_rust, healthy), en utilisant ViTImageProcessor pour redimensionner les images en 224×224 et les normaliser avec mean/std de 0,5. L'installation se fait via `pip install datasets transformers`.

Source :Hugging Face Blog · huggingface.co