Skip to main content
Ce guide explique comment exposer un Weave Model de W&B sous forme de point de terminaison FastAPI avec weave serve, afin d’interroger le modèle de manière interactive et de l’intégrer à vos flux de travail d’inférence en production. Pour démarrer un serveur FastAPI pour n’importe quel Weave Model, transmettez la réf. Weave à weave serve. Remplacez [REF] par la réf. de votre Weave Model.
Pour interroger le modèle de manière interactive, ouvrez l’interface Swagger UI à l’adresse http://0.0.0.0:9996/docs.

Installer FastAPI

weave serve utilise FastAPI et Uvicorn pour héberger le modèle. Vous devez donc installer ces deux paquets avant de servir le modèle.

Servir le modèle

Après avoir installé les dépendances, démarrez le serveur depuis un terminal. Remplacez [YOUR-MODEL-REF] par la réf. de votre Weave Model.
Pour obtenir la réf. de votre modèle, accédez au modèle et copiez-la depuis l’interface utilisateur. Elle doit se présenter sous la forme suivante, où [ENTITY] correspond à votre entity W&B, [PROJECT-NAME] au nom de votre projet, [MODEL-NAME] au nom du modèle et [HASH] au hachage de la version du modèle :
Pour tester le point de terminaison, ouvrez l’interface Swagger UI, cliquez sur le point de terminaison predict, puis sur Try it out. Vous disposez désormais d’un point de terminaison FastAPI local qui fournit des prédictions à partir de votre Weave Model.
Last modified on September 30, 2026