Skip to main content
Serverless Inférence vous donne accès aux principaux modèles de fondation open source via W&B Weave et une API compatible avec OpenAI.
  • Avec Inférence, vous pouvez créer des applications et des agents d’IA sans passer par un fournisseur d’hébergement ni héberger vous-même un modèle.
  • Avec Weave, vous pouvez tracer, évaluer, surveiller et améliorer vos applications basées sur Serverless Inférence.

Essayer Inférence dans l’interface utilisateur

Accédez à https://forge.coreweave.com/inference pour explorer les modèles disponibles et les essayer dans le Weave Playground. Pour plus d’informations sur l’interface web, consultez le guide de l’interface utilisateur.

Utiliser Inférence via l’API

Cet exemple en Python utilise Inférence pour envoyer une requête de complétion de chat à un LLM.

Étapes suivantes

  1. Configurez votre compte en suivant les prérequis.
  2. Consultez les modèles disponibles ainsi que les informations d’utilisation et les limites.
  3. Utilisez le service via l’API ou l’interface utilisateur.
  4. Testez les modèles pris en charge dans le W&B Weave Playground.
  5. Essayez les exemples d’utilisation.
Pour en savoir plus sur la tarification, les limites d’utilisation et les crédits, consultez Informations d’utilisation et limites.
Dernière modification le 30 septembre 2026