CommError, Run does not exist and ERROR Error uploading
Il se peut que l’ID de votre run W&B soit défini si W&B renvoie ces deux messages d’erreur. Par exemple, vous pourriez avoir un extrait de code similaire défini quelque part dans vos notebooks Jupyter ou dans votre script Python :
name lors de l’initialisation de W&B. Par exemple :
id de wandb.init(), le balayage peut attribuer ses propres ID de run uniques et les erreurs de téléversement disparaissent.
CUDA out of memory
Si vous voyez ce message d’erreur, refactorisez votre code pour utiliser des exécutions dans des processus distincts. Lorsque vous exécutez chaque essai dans son propre processus, W&B libère la mémoire GPU entre les runs.
Pour refactoriser votre code, effectuez les étapes suivantes :
-
Réécrivez votre code sous forme de script Python nommé
train.py. Ajoutez le nom du script d’entraînement (train.py) à votre fichier YAML de configuration du balayage (config.yamldans cet exemple) : -
Ajoutez ce qui suit à votre script Python
train.py: -
Depuis votre CLI, initialisez un balayage avec
wandb sweep: -
Notez l’ID du balayage renvoyé par W&B. Démarrez la tâche du balayage avec
wandb agentdepuis la CLI plutôt qu’avec le SDK Python (wandb.agent()). Remplacez[SWEEP-ID]dans l’extrait de code suivant par l’ID du balayage renvoyé par W&B à l’étape précédente :
anaconda 400 error
L’erreur suivante se produit généralement lorsque vous n’avez pas journalisé la métrique que vous optimisez :
metric à optimiser. Assurez-vous d’journaliser cette métrique avec wandb.Run.log(). Assurez-vous également d’utiliser le nom exact de la métrique que vous avez définie comme objectif d’optimisation du balayage dans votre script Python ou votre notebook Jupyter. Pour plus d’informations sur les fichiers de configuration, voir Définir la configuration d’un balayage.