> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Aperçu de l’API

> Choisissez entre la Management API et le proxy d’inférence.

Model Distillation expose deux interfaces HTTP publiques. Toutes deux utilisent une clé API W\&B pour l’authentification, mais leurs rôles et leurs contrôles d’isolation des locataires diffèrent.

| Interface | URL de base | Utilisation |
| - | - | - |
| Management API | `https://distillation.training.wandb.ai/v1` | Fournisseurs, projets, versions, acheminement, datasets, réétiquetage, modèles ayant fait l’objet d’un fine-tuning, évaluations et analyses |
| Proxy d’inférence | `https://proxy.training.wandb.ai/v1` | Complétions de chat compatibles avec OpenAI, par projet ou en appel direct au modèle |

<h2 id="management-api">
  Management API
</h2>

L’interface utilisateur s’appuie sur cette même API. Les ressources sont persistantes, et les opérations asynchrones renvoient généralement `202 Accepted` avec un état « en file d’attente », « en cours de build », « en cours d’exécution » ou « en attente ». Interrogez le point de terminaison GET de la ressource plutôt que de maintenir la requête ouverte.

L’en-tête facultatif `Wandb-Entity` permet de sélectionner une équipe à laquelle vous avez accès. Les chemins et les corps des ressources ne reprennent pas l’entity propriétaire.

<h2 id="inference-proxy">
  Proxy d’inférence
</h2>

Utilisez un SDK d’OpenAI avec l’URL de base du proxy. Le champ `model` permet de choisir un nom ou une version de modèle du proxy, ou `{provider}/{model}`. L’équipe (tenant) est sélectionnée via `metadata["wandb.entity"]` dans le corps de requête, ce qui garantit un fonctionnement cohérent avec tous les SDK d’OpenAI.

<h2 id="interactive-endpoint-pages">
  Pages de points de terminaison interactives
</h2>

Les pages de points de terminaison de cette section sont générées à partir des spécifications OpenAPI 3.1 versionnées dans le dépôt. Elles comprennent des générateurs de requêtes, des schémas, des codes de réponse et des exemples prêts à copier pour les deux interfaces.

<CardGroup cols={2}>
  <Card title="Management API" href="/fr/model-distillation/reference/management" arrow="true">
    Gérez les fournisseurs, les projets, les datasets, les modèles ayant fait l’objet d’un fine-tuning, les évaluations, l’acheminement et les analyses.
  </Card>

  <Card title="Proxy d’inférence" href="/fr/model-distillation/reference/proxy" arrow="true">
    Envoyez des requêtes de complétion de chat compatibles avec OpenAI via des projets ou des fournisseurs enregistrés.
  </Card>
</CardGroup>

Les agents peuvent commencer par [`llms.txt`](https://docs.coreweave.com/llms.txt), puis consulter directement les spécifications brutes [Management OpenAPI](/fr/openapi/model-distillation/management.openapi.yaml) ou [Inference proxy OpenAPI](/fr/openapi/model-distillation/proxy.openapi.yaml).

<Warning>
  Le playground envoie de vraies requêtes. La création de datasets, de modèles ayant fait l’objet d’un fine-tuning et d’évaluations peut consommer des ressources d’inférence ou d’entraînement ; les modifications de l’acheminement peuvent affecter le trafic de production.
</Warning>


## Related topics

- [Aperçu de l’API](/fr/products/inference/serverless/api-reference.md)
