연결하기 전에#
AI 액세스에는 로그인, 최소 USD 100의 확인된 충전 1회, 승인된 API 키, 요청에 충분한 가용 크레딧이 필요합니다. 이후 각 충전도 USD 100 최소 금액이 적용되며, 더 적은 잔액도 요청을 충당할 수 있으면 사용 가능합니다. 크레딧은 거래 확인이 필요합니다. 트래픽을 보내기 전에 서비스 상태에서 모델 가용성을 확인하세요. 키 필드에 Bearer 접두사 없이 자신의 API 키를 사용하세요. 기본 URL에는 이미 /v1이 포함되어 있습니다. 이 구성은 공식 문서를 기준으로 확인되었으며, 라이브 GPU 배포에 대해 테스트되지 않았습니다.
구성#
librechat.yaml에서 사용자 지정 엔드포인트를 구성하세요. 해당 환경 변수를 LibreChat 서버에 제공하고, 필요한 곳에 이 설정을 마운트한 다음 LibreChat을 다시 시작하세요.
endpoints:
custom:
- name: "Managed inference"
apiKey: "${WEIGHTSAPI_API_KEY}"
baseURL: "${https://weightsapi.com/v1}"
models:
default: ["Qwen/Qwen3-32B"]
fetch: false
titleConvo: false
modelDisplayLabel: "Qwen3 32B"
apiKey, baseURL, models.default은(는) 문서화된 사용자 지정 엔드포인트 필드입니다. fetch: false은(는) 명시적 모델 목록을 사용합니다. provider을(를) 생략하면 OpenAI 호환 클라이언트를 사용합니다. titleConvo: false은(는) 추가 제목 생성 호출을 방지합니다. 설치된 버전의 최상위 config 버전을 유지하면서 기존 파일에 병합하세요.
출처: 사용자 지정 엔드포인트 구조, 설정 설치.
연결 확인#
모델 목록을 가져온 다음 짧은 메시지를 하나 보내세요. 모델 목록 성공이 도구, 비전 또는 JSON 스키마 지원을 증명하지는 않습니다. 활성화하기 전에 선택한 배포의 기능을 확인하세요.