Pourquoi utiliser W&B

- Tableau de bord unifié : dépôt central pour toutes les métriques et prédictions de votre modèle.
- Léger : aucune modification du code n’est nécessaire pour l’intégrer à Hugging Face.
- Accessible : gratuit pour les particuliers et les équipes universitaires.
- Sécurisé : tous les projets sont privés par défaut.
- Fiable : utilisé par des équipes de machine learning chez OpenAI, Toyota, Lyft et bien d’autres.
Installez, importez et connectez-vous
Cette section configure l’environnement nécessaire pour exécuter le tutoriel. Installez les bibliothèques Hugging Face et W&B, puis téléchargez le dataset GLUE et le script d’entraînement pour ce tutoriel :- Hugging Face Transformers : modèles et datasets de traitement du langage naturel.
- W&B : suivi des expériences et visualisation.
- GLUE dataset : dataset de référence pour la compréhension du langage.
- GLUE script : script d’entraînement de modèle pour la classification de séquences.
Ajoutez votre clé API
L’authentification à l’aide de votre clé API associe ce notebook à votre compte W&B, afin que les runs soient enregistrés dans vos projets. Après votre inscription, exécutez la cellule suivante et cliquez sur le lien pour obtenir votre clé API et authentifier ce notebook.WANDB_WATCH=all. Voir le guide d’intégration Hugging Face pour la liste complète des options.
Entraîner le modèle
Une fois l’environnement configuré et l’authentification terminée, vous êtes prêt à démarrer un run d’entraînement. Ensuite, exécutez le script d’entraînement téléchargérun_glue.py et constatez que l’entraînement est automatiquement suivi dans le tableau de bord W&B. Ce script effectue le fine-tuning de BERT sur le Microsoft Research Paraphrase Corpus — des paires de phrases avec des annotations humaines indiquant si elles sont sémantiquement équivalentes.
Visualisez les résultats dans le tableau de bord
Une fois l’entraînement lancé, vous pouvez surveiller les métriques en temps réel. Cliquez sur le lien affiché par la cellule précédente ou rendez-vous sur wandb.ai pour voir vos résultats s’afficher en direct. Le lien pour voir votre run dans le navigateur apparaît une fois toutes les dépendances chargées. Recherchez la sortie suivante : “wandb: View run at [URL to your unique run]”Visualisez les performances du modèle
Parcourez les expériences, zoomez sur les résultats intéressants et visualisez des données à forte dimensionnalité.
Comparez les architectures
Voici un exemple comparant BERT versus DistilBERT. Les graphiques en courbes générés automatiquement montrent comment différentes architectures influencent la précision de l’évaluation tout au long de l’entraînement.
Suivre automatiquement les informations clés
Cette section décrit ce que W&B capture automatiquement afin que vous sachiez quelles données sont disponibles dans votre tableau de bord sans configuration supplémentaire. W&B enregistre un nouveau run pour chaque expérience. Voici les informations enregistrées par défaut :- Hyperparamètres : W&B enregistre les paramètres de votre modèle dans Config.
- Métriques du modèle : W&B enregistre les données de séries temporelles des métriques envoyées à Log.
- Journaux du terminal : W&B enregistre les sorties de la ligne de commande et les affiche dans un onglet.
- Métriques système : utilisation du GPU et du CPU, mémoire et température.