가격
가격은 추론, 트레이닝, 저장소의 세 가지 컴포넌트로 구성됩니다. 구체적인 요금은 가격 페이지에서 확인하세요. 각 컴포넌트에 대한 설명은 다음 섹션을 참조하세요.추론
Serverless Training 추론 요청의 가격은 Serverless Inference 가격과 동일합니다. 모델별 비용을 확인하세요. 크레딧 구매, 계정 등급, 사용 한도에 대한 자세한 내용은 Serverless Inference 문서를 참조하세요.트레이닝
Serverless Training은 트레이닝 스텝마다 에이전트의 출력과 해당 보상(보상 함수로 계산)이 담긴 트래젝터리 배치를 수집합니다. 그런 다음 이 트래젝터리 배치를 사용해 LoRA 어댑터의 가중치를 업데이트합니다. LoRA 어댑터는 기본 모델을 사용자의 작업에 맞게 특화하는 역할을 합니다. LoRA를 업데이트하는 트레이닝 작업은 Serverless Training이 관리하는 전용 GPU cluster에서 실행됩니다. 공개 프리뷰 기간에는 트레이닝이 무료입니다.모델 저장소
Serverless Training은 트레이닝한 LoRA의 체크포인트를 저장하므로 언제든지 해당 LoRA를 평가하거나 서빙하거나 이어서 트레이닝할 수 있습니다. W&B는 전체 체크포인트 크기와 가격 플랜에 따라 저장소 요금을 매월 청구합니다. 모든 플랜에는 최소 5GB의 무료 저장소가 포함되며, 이는 LoRA 약 30개를 저장할 수 있는 용량입니다. 공간을 절약하려면 성능이 낮은 LoRA를 삭제하세요. 자세한 방법은 ART SDK를 참조하세요.한도
Serverless Training을 사용할 때는 다음 한도가 적용됩니다. 워크로드 사이징을 계획하거나 새 리전에서 서비스를 사용하려는 경우 이 한도를 확인하세요.-
추론 동시성 한도: 기본적으로 Serverless Training은 사용자당 최대 2,000개, 프로젝트당 최대 6,000개의 동시 요청을 지원합니다. 요청 속도 제한을 초과하면 Inference API가
429 Concurrency limit reached for requests응답을 반환합니다. 이 오류를 방지하려면 트레이닝 작업이나 프로덕션 워크로드에서 동시에 보내는 요청 수를 줄이세요. 요청 속도 제한을 높여야 하는 경우 forge-support@coreweave.com 으로 요청하세요. - 지리적 제한: Serverless Training은 지원되는 위치에서만 사용 가능하다. 자세한 내용은 서비스 약관을 참조하세요.