Skip to main content
Weave assure le suivi du coût des appels LLM de deux manières :
  • Suivi automatique des coûts : pour les intégrations prises en charge, Weave capture l’utilisation des jetons à partir de la réponse de l’API et applique la tarification intégrée du modèle, sans aucun code supplémentaire.
  • Suivi personnalisé des coûts : pour les modèles affinés, les modèles auto-hébergés ou les modèles pour lesquels Weave ne propose pas d’intégration automatique, configurez Weave afin de suivre des coûts personnalisés à l’aide des méthodes d’API disponibles.
Le SDK TypeScript de Weave ne prend pas en charge le suivi des coûts.

Utiliser le suivi automatique des coûts

Lorsque vous appelez weave.init() et utilisez une intégration LLM prise en charge telle qu’OpenAI, Anthropic, Cohere ou Mistral, Weave enregistre automatiquement l’utilisation des jetons et calcule le coût de chaque appel. Les coûts s’affichent dans l’arborescence de trace et dans le tableau des appels de l’interface Weights & Biases. Ils sont également accessibles par programmation dans call.summary["weave"]["costs"] lorsque vous interrogez les appels avec le paramètre include_costs défini sur true. Le suivi automatique des coûts nécessite que deux conditions soient réunies :
  • Le fournisseur de LLM fait partie des intégrations prises en charge.
  • La réponse de l’API inclut l’utilisation des jetons (la plupart des fournisseurs la renvoient par défaut).
Si l’une de ces conditions n’est pas remplie, utilisez plutôt le suivi personnalisé des coûts. L’exemple suivant montre comment récupérer par programmation les données de coûts automatiques :

Ajouter un coût personnalisé

Utilisez le suivi personnalisé des coûts lorsque le suivi automatique des coûts n’est pas disponible, par exemple pour des modèles affinés, des modèles auto-hébergés ou des fournisseurs avec lesquels Weave ne propose pas d’intégration. Les sections suivantes expliquent comment ajouter, interroger, purger et agréger des coûts personnalisés. Ajoutez un coût personnalisé à l’aide de la méthode add_cost. Les trois champs requis sont llm_id, prompt_token_cost et completion_token_cost. llm_id est le nom du LLM (par exemple, gpt-4o). prompt_token_cost et completion_token_cost correspondent au coût par jeton du LLM. Si les prix du LLM sont exprimés par million de jetons, convertissez la valeur. Vous pouvez également attribuer une valeur datetime à effective_date pour que le coût prenne effet à une date donnée. Par défaut, il s’agit de la date du jour.

Interroger les coûts personnalisés

Après avoir ajouté des coûts personnalisés, vous pouvez les récupérer pour vérifier leurs valeurs ou retrouver l’ID de coût nécessaire à d’autres opérations, comme la purge. Interrogez les coûts avec la méthode query_costs. Vous pouvez interroger les coûts de plusieurs façons : en transmettant un seul ID de coût ou une liste de noms de modèles LLM.

Purger un coût personnalisé

Pour purger un coût personnalisé, utilisez la méthode purge_costs. Transmettez-lui une liste d’ID de coûts : Weave purge alors les coûts correspondants.

Calculer les coûts personnalisés d’un projet

Pour connaître les dépenses totales d’un projet, agrégez les coûts par appel renvoyés par Weave. Pour calculer les coûts d’un projet, utilisez get_calls() avec include_costs=True.

Configurer un modèle personnalisé avec des coûts personnalisés

Pour un guide pas à pas complet combinant un modèle personnalisé et le suivi personnalisé des coûts, essayez le cookbook sur la configuration des coûts avec un modèle personnalisé.

Essayer dans Colab

Dernière modification le 30 septembre 2026