> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# API 개요

> Management API와 inference proxy 중 적합한 것을 선택하세요.

Model Distillation은 두 가지 공개 HTTP 인터페이스를 제공합니다. 두 인터페이스 모두 W\&B API 키로 인증하지만, 담당하는 역할과 테넌시 제어 방식은 서로 다릅니다.

| 인터페이스 | Base URL | 용도 |
| - | - | - |
| Management API | `https://distillation.training.wandb.ai/v1` | 공급자, 프로젝트, 버전, 라우팅, 데이터셋, 재레이블링, 파인튜닝, 평가 및 분석 |
| Inference proxy | `https://proxy.training.wandb.ai/v1` | OpenAI 호환 프로젝트 및 모델 직접 호출 Chat Completion |

<h2 id="management-api">
  Management API
</h2>

UI도 이와 동일한 API를 사용합니다. 리소스는 영구적으로 유지되며, 비동기 오퍼레이션은 일반적으로 `202 Accepted`와 함께 queued, building, running 또는 pending 상태를 반환합니다. 요청을 열어 둔 채 기다리지 말고 리소스의 GET 엔드포인트를 폴링하세요.

선택 사항인 `Wandb-Entity` 헤더로 액세스 가능한 팀을 지정할 수 있습니다. 리소스 경로와 본문에는 entity 소유 정보를 다시 명시하지 않습니다.

<h2 id="inference-proxy">
  Inference proxy
</h2>

OpenAI SDK에서 프록시 base URL을 지정하여 사용하세요. `model` 필드로 프록시 모델 이름/버전 또는 `{provider}/{model}`을 지정합니다. 팀 테넌시는 요청 본문의 `metadata["wandb.entity"]`로 지정하므로 어떤 OpenAI SDK에서든 일관되게 작동합니다.

<h2 id="interactive-endpoint-pages">
  대화형 엔드포인트 페이지
</h2>

이 섹션의 엔드포인트 페이지는 저장소에 체크인된 OpenAPI 3.1 사양을 바탕으로 생성됩니다. 두 API 모두에 대해 요청 빌더, 스키마, 응답 코드, 복사할 수 있는 예시를 제공합니다.

<CardGroup cols={2}>
  <Card title="Management API" href="/ko/model-distillation/reference/management" arrow="true">
    공급자, 프로젝트, 데이터셋, 파인튜닝, 평가, 라우팅, 분석을 관리합니다.
  </Card>

  <Card title="Inference proxy" href="/ko/model-distillation/reference/proxy" arrow="true">
    프로젝트 또는 등록된 공급자를 통해 OpenAI 호환 Chat Completion 요청을 보냅니다.
  </Card>
</CardGroup>

에이전트는 [`llms.txt`](https://docs.coreweave.com/llms.txt)부터 시작해 원본 [Management OpenAPI](/ko/openapi/model-distillation/management.openapi.yaml) 또는 [Inference proxy OpenAPI](/ko/openapi/model-distillation/proxy.openapi.yaml) 사양을 직접 조회할 수 있습니다.

<Warning>
  플레이그라운드는 실제 요청을 보냅니다. 데이터셋, 파인튜닝, 평가를 생성하면 추론 또는 트레이닝 리소스가 소비될 수 있으며, 라우팅 쓰기 작업은 프로덕션 트래픽에 영향을 줄 수 있습니다.
</Warning>
