> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Analytics

> Surveillez le trafic, les jetons, les erreurs et le coût des modèles à partir des traces attribuées aux projets.

Analytics lit les traces de projet canoniques directement depuis W\&B, plutôt que de maintenir une base de données distincte d’événements de requête. Cette fonctionnalité vous permet de vérifier le déploiement progressif et d’estimer l’impact économique du remplacement d’un modèle.

<h2 id="available-views">
  Vues disponibles
</h2>

* volume de requêtes dans le temps ;
* part du trafic par modèle cible du routage ;
* répartition par version de projet ;
* volume de jetons en entrée et en sortie ;
* erreurs des fournisseurs ;
* coût estimé en entrée, en sortie et total ;
* modèles de comparaison qui ne reçoivent actuellement aucun trafic.

Choisissez une plage comprise entre une heure et trois mois. Les plages longues utilisent des tranches temporelles plus larges.

<h2 id="pricing-coverage">
  Couverture de la tarification
</h2>

Les coûts sont des estimations. L’interface utilise, par ordre de priorité :

1. un prix de modèle défini manuellement sur le fournisseur ou le modèle fine-tuné ;
2. la tarification W\&B Inference du modèle de base d’un modèle fine-tuné ;
3. le catalogue LiteLLM intégré, si un modèle correspondant y figure.

La page indique le pourcentage d’appels disposant d’informations de tarification suffisantes. Ne comparez des modèles que si leur couverture est similaire.

Les réponses rejouées depuis le [cache de réponses exactes](/fr/model-distillation/proxy/response-caching) conservent leur nombre de jetons d’origine, mais sont facturées à zéro, car aucune inférence n’a été exécutée chez le fournisseur.

<h2 id="use-analytics-during-rollout">
  Utiliser Analytics pendant le déploiement progressif
</h2>

Après avoir modifié l’acheminement, vérifiez que :

* le nouveau modèle reçoit la part de trafic prévue ;
* l’ancien modèle conserve le poids résiduel attendu ou un poids nul ;
* le taux d’erreur n’augmente pas ;
* le volume de jetons et le comportement de fin de génération restent cohérents ;
* le coût estimé évolue dans le sens attendu.

Les décisions relatives à la qualité doivent toujours reposer sur les évaluations et les métriques produit, et non sur les seuls graphiques de coûts.

<Accordion title="API : Lire les analyses du projet (GET /tasks/{alias}/analytics)">
  Le paramètre de requête `time_range` accepte des fenêtres relatives telles que `1h`, `24h`, `5d`, `30d` ou `12w` :

  ```bash theme={"system"}
  curl --url "https://distillation.training.wandb.ai/v1/tasks/ticket-classifier/analytics?time_range=30d" \
    --header "Authorization: Bearer $WANDB_API_KEY" \
    --header "Wandb-Entity: your-team"
  ```

  Pour le schéma de la réponse, voir [Obtenir Analytics d’une tâche](/fr/model-distillation/reference/management/analytics/get-task-analytics).
</Accordion>
