- 팀에서 OpenAI-compatible API를 통해 서빙하는 에이전트 또는 모델 프로토타입
- 자체 호스팅 또는 로컬 모델(예: Ollama 또는 vLLM으로 서빙하는 모델)
- Weave에서 기본적으로 지원하지 않는 공급자 또는 모델 버전
맞춤형 런타임을 사용할 수 있는 곳
등록된 맞춤형 런타임의 모델은 다음 위치의 모델 선택기에 표시됩니다.- 플레이그라운드: 엔드포인트와 대화형으로 채팅합니다.
- Evaluation 플레이그라운드: 엔드포인트를 다른 모델과 비교하고 평가합니다.
- Signals: 수신 트레이스에 점수를 매기는 평가 모델로 엔드포인트를 사용합니다.
- Scorer 반복 및 Agent Signals 모델 선택기
- Weave completions API: 모델 ID
custom::<runtime-name>::<runtime-id>를completions/create엔드포인트에 전달하여 프로그래밍 방식으로 엔드포인트에 대해 트레이스된 completions를 실행합니다. Service API 레퍼런스를 참조하세요.
맞춤형 런타임 추가
코드 또는 Weave UI를 사용하여 프로젝트에 맞춤형 런타임을 추가할 수 있습니다. 맞춤형 런타임을 추가하려면 다음 런타임 정보가 필요합니다.코드를 사용하여 맞춤형 런타임 추가
이전 섹션에서 설명한 런타임 정보를 바탕으로 다음 등록 요청의 적절한 필드를 업데이트한 후 실행하여 프로젝트에서 맞춤형 런타임을 생성하거나 업데이트합니다. 프로그래밍 방식으로 등록하려면weave Python 패키지 버전 0.53.4 이상 또는 weave npm 패키지 버전 0.16.5 이상이 필요합니다.
- Python
- TypeScript
custom::<runtime-name>::<runtime-id> 형식으로 참조합니다. 호출이 성공하면 UI에서 등록한 런타임과 마찬가지로 해당 런타임의 모델이 런타임 이름 아래의 모델 선택기에 표시됩니다.
런타임을 업데이트한 후 캐시가 만료될 때까지 최대 60초 동안 추론에 이전 설정이 계속 사용될 수 있습니다.
UI에서 맞춤형 런타임 등록
W&B UI에서 맞춤형 런타임을 등록하려면 다음 단계를 따르세요.- Weave 사이드바에서 Project를 선택한 후 AI Providers 탭을 선택합니다. 또는 플레이그라운드 모델 선택기에서 Configure providers를 클릭합니다.
- Add custom runtime을 클릭합니다. 설정 패널이 열립니다.
- 패널에서 런타임 이름, 기본 URL, 하나 이상의 런타임 ID를 입력합니다. 필요에 따라 API 키 시크릿과 맞춤형 헤더를 추가합니다.
- 런타임을 저장합니다.
