Skip to main content
Ces exemples montrent comment utiliser Serverless Inference avec Weave pour le traçage, l’évaluation et la comparaison. Suivez-les pour apprendre à instrumenter les appels de modèle afin d’observer leur comportement, de mesurer leurs performances sur un jeu de données et de comparer des modèles côte à côte. Les sections suivantes présentent un exemple de traçage de base, puis un flux de travail d’évaluation plus avancé. Avant d’exécuter l’un ou l’autre de ces exemples, assurez-vous de remplir les prérequis.

Exemple de base : tracer Llama 3.1 8B avec Weave

Cet exemple montre comment envoyer un prompt au modèle Llama 3.1 8B et tracer l’appel avec Weave. Le traçage capture l’intégralité de l’entrée et de la sortie de l’appel LLM, surveille les performances et vous permet d’analyser les résultats dans l’interface Weave.
En savoir plus sur le traçage dans Weave.
Dans cet exemple :
  • Vous définissez une fonction décorée avec @weave.op() qui envoie une requête de complétion de chat.
  • Weave enregistre vos traces et les associe à votre entity et à votre projet W&B.
  • Weave trace automatiquement la fonction et journalise les entrées, les sorties, la latence et les métadonnées.
  • Le résultat s’affiche dans le terminal et la trace apparaît dans l’onglet Traces sur Forge.
Après avoir exécuté le code, affichez la trace dans Weave de l’une des manières suivantes :
  • Cliquez sur le lien affiché dans le terminal. Par exemple, https://wandb.ai/[YOUR-TEAM]/[YOUR-PROJECT]/r/call/01977f8f-839d-7dda-b0c2-27292ef0e04g.
  • Accédez à Forge et sélectionnez l’onglet Traces.
Une fois la trace de base opérationnelle, vous pouvez passer à un flux de travail plus complet, qui ne se limite pas à l’inspection d’appels individuels.

Exemple avancé : utiliser les évaluations et les leaderboards Weave

Outre le traçage des appels de modèle, vous pouvez évaluer les performances et publier des leaderboards. Cet exemple compare deux modèles sur un jeu de données de questions-réponses afin de montrer comment Llama 3.1 8B et DeepSeek V3.1 se comportent face aux mêmes prompts.
Après avoir exécuté ce code, accédez à votre compte W&B sur Forge et procédez comme suit :
Afficher vos évaluations de modèles
Afficher votre leaderboard
Une fois les deux exemples terminés, vous disposez d’un ensemble d’appels de modèle tracés, d’une évaluation publiée et d’un leaderboard qui compare les modèles sur votre jeu de données.

Étapes suivantes

Pour continuer à explorer Serverless Inference, voici quelques pistes :
Dernière modification le 30 septembre 2026