Créez une complétion de chat à l’aide du point de terminaison /chat/completions. Ce point de terminaison respecte le format d’OpenAI pour l’envoi de messages et la réception des réponses.
Prérequis
Pour créer une complétion de chat, fournissez :
- L’URL de base du service d’Inférence :
https://api.inference.wandb.ai/v1.
- Votre clé API W&B :
[YOUR-API-KEY].
- Votre équipe W&B et votre projet :
[YOUR-TEAM]/[YOUR-PROJECT] (facultatif).
- Un ID de modèle choisi parmi les modèles disponibles.
Exemples de requêtes
Les exemples suivants montrent comment envoyer une requête de complétion de chat avec Python et curl. Remplacez les valeurs d’espace réservé par votre propre clé API, votre équipe et votre projet (facultatifs), ainsi que par un ID de modèle.
Une requête réussie renvoie une réponse au format suivant, compatible avec OpenAI, qui contient le message de l’assistant généré ainsi que le détail de l’utilisation des jetons.
Dernière modification le 30 septembre 2026