- 팀에서 OpenAI-compatible API로 서빙하는 에이전트 또는 모델 프로토타입
- 자체 호스팅 모델 또는 로컬 모델(예: Ollama나 vLLM으로 서빙하는 모델)
- Weave가 기본으로 지원하지 않는 공급자 또는 모델 버전
맞춤형 런타임을 사용할 수 있는 곳
등록된 맞춤형 런타임의 모델은 다음 위치의 모델 선택기에 나타납니다:- 플레이그라운드: 엔드포인트와 대화형으로 채팅하세요.
- Evaluation Playground: 다른 모델과 엔드포인트를 평가하고 비교하세요.
- 시그널: 들어오는 트레이스에 점수를 매기는 평가 모델로 엔드포인트를 사용하세요.
- Scorer iteration 및 Agent Signals 모델 선택기.
- Weave completions API:
custom::<runtime-name>::<runtime-id>모델 ID를completions/create엔드포인트에 전달하여 엔드포인트에 대해 traced completion을 프로그래밍 방식으로 실행하세요. service API reference를 참조하세요.
맞춤형 런타임 추가
코드 또는 Weights & Biases UI를 사용하여 프로젝트에 맞춤형 런타임을 추가할 수 있습니다. 맞춤형 런타임을 추가하려면 런타임에 대한 다음 정보가 필요합니다:코드로 맞춤형 런타임 추가하기
이전 섹션에서 정리한 런타임 정보로 다음 등록 요청의 해당 필드를 수정한 후 실행하면 프로젝트에 맞춤형 런타임을 생성하거나 업데이트할 수 있습니다. 프로그래밍 방식으로 등록하려면weave Python 패키지 버전 0.53.4 이상 또는 weave npm 패키지 버전 0.16.5 이상이 필요합니다.
- Python
- TypeScript
custom::<runtime-name>::<runtime-id> 형식으로 참조됩니다. 호출이 성공하면 UI에서 등록한 런타임과 마찬가지로 런타임의 모델이 모델 선택기의 런타임 이름 아래에 표시됩니다.
런타임을 업데이트한 후에도 캐시가 만료될 때까지 최대 60초 동안 추론에 이전 설정이 계속 사용될 수 있습니다.
UI에서 맞춤형 런타임 등록
Weights & Biases UI에서 맞춤형 런타임을 등록하려면:- Weave 사이드바에서 Project를 선택한 다음 AI Providers 탭을 선택하세요. 또는 플레이그라운드 모델 선택기에서 Configure providers를 클릭하세요.
- Add custom runtime를 클릭하세요. 그러면 설정 드로어가 열립니다.
- 드로어에서 런타임의 이름, base URL, 하나 이상의 런타임 ID를 입력하세요. 선택적으로 API 키 시크릿과 맞춤형 헤더를 추가할 수 있습니다.
- 런타임을 저장하세요.
