Skip to main content
Model Distillation은 두 가지 공개 HTTP 인터페이스를 제공합니다. 두 인터페이스 모두 W&B API 키로 인증하지만, 담당하는 역할과 테넌시 제어 방식은 서로 다릅니다.

Management API

UI도 이와 동일한 API를 사용합니다. 리소스는 영구적으로 유지되며, 비동기 오퍼레이션은 일반적으로 202 Accepted와 함께 queued, building, running 또는 pending 상태를 반환합니다. 요청을 열어 둔 채 기다리지 말고 리소스의 GET 엔드포인트를 폴링하세요. 선택 사항인 Wandb-Entity 헤더로 액세스 가능한 팀을 지정할 수 있습니다. 리소스 경로와 본문에는 entity 소유 정보를 다시 명시하지 않습니다.

Inference proxy

OpenAI SDK에서 프록시 base URL을 지정하여 사용하세요. model 필드로 프록시 모델 이름/버전 또는 {provider}/{model}을 지정합니다. 팀 테넌시는 요청 본문의 metadata["wandb.entity"]로 지정하므로 어떤 OpenAI SDK에서든 일관되게 작동합니다.

대화형 엔드포인트 페이지

이 섹션의 엔드포인트 페이지는 저장소에 체크인된 OpenAPI 3.1 사양을 바탕으로 생성됩니다. 두 API 모두에 대해 요청 빌더, 스키마, 응답 코드, 복사할 수 있는 예시를 제공합니다.

Management API

공급자, 프로젝트, 데이터셋, 파인튜닝, 평가, 라우팅, 분석을 관리합니다.

Inference proxy

프로젝트 또는 등록된 공급자를 통해 OpenAI 호환 Chat Completion 요청을 보냅니다.
에이전트는 llms.txt부터 시작해 원본 Management OpenAPI 또는 Inference proxy OpenAPI 사양을 직접 조회할 수 있습니다.
플레이그라운드는 실제 요청을 보냅니다. 데이터셋, 파인튜닝, 평가를 생성하면 추론 또는 트레이닝 리소스가 소비될 수 있으며, 라우팅 쓰기 작업은 프로덕션 트래픽에 영향을 줄 수 있습니다.
마지막 수정일 2026년 9월 30일