Skip to main content
Analytics lit les traces de projet canoniques directement depuis W&B, plutôt que de maintenir une base de données distincte d’événements de requête. Cette fonctionnalité vous permet de vérifier le déploiement progressif et d’estimer l’impact économique du remplacement d’un modèle.

Vues disponibles

  • volume de requêtes dans le temps ;
  • part du trafic par modèle cible du routage ;
  • répartition par version de projet ;
  • volume de jetons en entrée et en sortie ;
  • erreurs des fournisseurs ;
  • coût estimé en entrée, en sortie et total ;
  • modèles de comparaison qui ne reçoivent actuellement aucun trafic.
Choisissez une plage comprise entre une heure et trois mois. Les plages longues utilisent des tranches temporelles plus larges.

Couverture de la tarification

Les coûts sont des estimations. L’interface utilise, par ordre de priorité :
  1. un prix de modèle défini manuellement sur le fournisseur ou le modèle fine-tuné ;
  2. la tarification W&B Inference du modèle de base d’un modèle fine-tuné ;
  3. le catalogue LiteLLM intégré, si un modèle correspondant y figure.
La page indique le pourcentage d’appels disposant d’informations de tarification suffisantes. Ne comparez des modèles que si leur couverture est similaire. Les réponses rejouées depuis le cache de réponses exactes conservent leur nombre de jetons d’origine, mais sont facturées à zéro, car aucune inférence n’a été exécutée chez le fournisseur.

Utiliser Analytics pendant le déploiement progressif

Après avoir modifié l’acheminement, vérifiez que :
  • le nouveau modèle reçoit la part de trafic prévue ;
  • l’ancien modèle conserve le poids résiduel attendu ou un poids nul ;
  • le taux d’erreur n’augmente pas ;
  • le volume de jetons et le comportement de fin de génération restent cohérents ;
  • le coût estimé évolue dans le sens attendu.
Les décisions relatives à la qualité doivent toujours reposer sur les évaluations et les métriques produit, et non sur les seuls graphiques de coûts.
Le paramètre de requête time_range accepte des fenêtres relatives telles que 1h, 24h, 5d, 30d ou 12w :
Pour le schéma de la réponse, voir Obtenir Analytics d’une tâche.
Dernière modification le 30 septembre 2026