Skip to main content
Serverless Inference를 사용하면 W&B Weave와 OpenAI 호환 API를 통해 주요 오픈 소스 파운데이션 모델에 액세스할 수 있습니다.
  • Inference를 사용하면 호스팅 공급자에 가입하거나 모델을 직접 호스팅하지 않고도 AI 애플리케이션과 에이전트를 구축할 수 있습니다.
  • Weave를 사용하면 Serverless Inference 기반 애플리케이션을 트레이스, 평가, 모니터링하고 개선할 수 있습니다.

UI에서 Inference 사용해 보기

https://forge.coreweave.com/inference로 이동하여 사용 가능한 모델을 살펴보고 Weave 플레이그라운드에서 직접 사용해 보세요. 웹 인터페이스에 대한 자세한 내용은 UI 가이드를 참조하세요.

API를 통해 Inference 사용하기

이 Python 예시는 Inference를 사용하여 LLM에 Chat Completion 요청을 보냅니다.

다음 단계

  1. 사전 요구 사항에 따라 계정을 설정하세요.
  2. 사용 가능한 모델과 사용 정보 및 제한을 검토하세요.
  3. API 또는 UI를 통해 서비스를 사용하세요.
  4. W&B Weave 플레이그라운드에서 지원되는 모델을 사용해 보세요.
  5. 사용 예시를 사용해 보세요.
가격, 사용 제한, 크레딧에 대한 정보는 사용 정보 및 제한을 참조하세요.
마지막 수정일 2026년 9월 30일