Skip to main content
Observez les alertes d’infrastructure, comme les pannes de GPU, les dépassements thermiques et bien d’autres, pendant les expériences de machine learning que vous journalisez dans W&B. Lorsque vous exécutez vos charges de travail sur un cluster CoreWeave Kubernetes Service (CKS) pris en charge, que vous activez cette intégration et que vous remplissez les prérequis décrits sur cette page, CoreWeave Mission Control peut surveiller votre infrastructure de calcul pendant un run W&B.
Cette fonctionnalité est en préversion. Pour y accéder, contactez votre représentant W&B.

Prérequis

Les conditions suivantes doivent être remplies pour que cette intégration fonctionne de bout en bout. En cas d’erreur, CoreWeave transmet ces informations à W&B, qui ajoute les informations d’infrastructure aux graphiques de votre run dans le workspace de votre projet. CoreWeave tente de résoudre automatiquement certains problèmes, et W&B affiche ces informations sur la page du run.
Dernière modification le 30 septembre 2026