Hugging Face Blog·· 2022-02-11AI Score22
Fine-tuner ViT pour la classification d'images avec 🤗 Transformers
Fine-Tune ViT for Image Classification with 🤗 Transformers
AI Introduction
Hugging Face détaille le fine-tuning du Vision Transformer (ViT) pour la classification d'images via les bibliothèques 🤗 datasets et transformers. Le tutoriel s'appuie sur le modèle google/vit-base-patch16-224-in21k et le jeu de données beans (3 classes : angular_leaf_spot, bean_rust, healthy), en utilisant ViTImageProcessor pour redimensionner les images en 224×224 et les normaliser avec mean/std de 0,5. L'installation se fait via `pip install datasets transformers`.
Source :Hugging Face Blog · huggingface.co