> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# API 개요

> 엔드포인트와 인증을 포함한 Serverless Inference 서비스의 전체 REST API 레퍼런스를 살펴보세요.

이 레퍼런스에서는 Serverless Inference REST API를 설명합니다. 이 API를 사용하면 자체 애플리케이션에서 파운데이션 모델을 프로그래밍 방식으로 호출할 수 있습니다. 모델 인프라를 직접 관리할 필요 없이 호스팅된 추론을 서비스, 스크립트, 노트북에 통합할 수 있습니다.

<Note>
  이 API는 Serverless Inference에서 호스팅하는 모델을 호출합니다. Dedicated Inference 게이트웨이, 배포, 용량 클레임을 관리하려면 [Dedicated Inference API 레퍼런스](/products/inference/reference/api-overview)를 참조하세요. Serverless Inference, Dedicated Inference, Inference on CKS 간의 비교는 [CoreWeave Inference 소개](/products/inference#choose-a-deployment-option)를 참조하세요.
</Note>

<h2 id="base-url">
  기본 URL
</h2>

Inference 서비스에는 다음 주소로 액세스하세요.

```plaintext theme={"system"}
https://api.inference.wandb.ai/v1
```

<h2 id="prerequisites">
  사전 요구 사항
</h2>

Inference API를 호출하려면 다음이 필요합니다.

* Inference 크레딧이 있는 W\&B 계정
* 유효한 W\&B API 키

둘 이상의 팀에 속해 있거나 사용량을 특정 프로젝트로 집계하려면 팀 ID와 프로젝트 ID도 필요합니다. 코드 샘플에서는 이 값을 `[YOUR-TEAM]/[YOUR-PROJECT]`로 표시합니다. 이 값을 지정하지 않으면 W\&B는 기본 entity와 `inference`라는 프로젝트 이름을 사용합니다.

<h2 id="available-methods">
  사용 가능한 메서드
</h2>

Inference API는 파운데이션 모델과 상호 작용할 수 있는 OpenAI 호환 엔드포인트를 제공합니다. 사용 가능한 메서드는 다음과 같습니다.

* **[Chat Completions](/ko/products/inference/serverless/api-reference/chat-completions)**: 파운데이션 모델로 Chat Completion을 생성합니다.
* **[모델 목록](/ko/products/inference/serverless/api-reference/list-models)**: 사용 가능한 모든 모델과 모델 ID를 조회합니다.

<h2 id="authentication">
  인증
</h2>

모든 API 요청은 W\&B API 키로 인증해야 합니다. API 키는 [forge.coreweave.com/settings](https://forge.coreweave.com/settings)에서 생성할 수 있습니다.

요청 헤더에 API 키를 포함하세요.

* OpenAI SDK를 사용하는 경우 `api_key` 매개변수를 설정하세요.
* API를 직접 호출하는 경우 `Authorization: Bearer [YOUR-API-KEY]`를 사용하세요.

<h2 id="error-handling">
  오류 처리
</h2>

전체 오류 코드 목록과 해결 방법은 [API 오류](/ko/support/inference)를 참조하세요.

<h2 id="next-steps">
  다음 단계
</h2>

API 키를 발급받은 후 다음 중 하나를 진행하세요.

* [사용 예시](/ko/products/inference/serverless/examples)를 직접 사용해 보면서 API의 작동 방식을 확인하세요.
* [Inference UI](/ko/products/inference/serverless/ui-guide)에서 모델을 살펴보세요.
* 계정의 [사용 한도](/ko/products/inference/serverless/usage-limits)를 확인하세요.


## Related topics

- [API 개요](/ko/model-distillation/reference/overview.md)
