Antes de conectar#
O acesso à IA requer login, uma recarga confirmada de pelo menos USD 100, uma chave de API autorizada e crédito disponível suficiente para a solicitação. Cada recarga posterior também tem um mínimo de USD 100; saldos restantes menores permanecem utilizáveis quando cobrem a solicitação. O crédito requer verificação da transação. Verifique o status do serviço para disponibilidade do modelo antes de enviar tráfego. Use sua própria chave de API sem o prefixo Bearer nos campos de chave. A URL base já inclui /v1. Essas configurações foram verificadas contra a documentação oficial, não testadas contra uma implantação de GPU ao vivo.
Configuración#
Configure el endpoint personalizado en librechat.yaml; proporcione sus variables de entorno al servidor de LibreChat, monte esta configuración donde corresponda y reinicie LibreChat.
endpoints:
custom:
- name: "Managed inference"
apiKey: "${WEIGHTSAPI_API_KEY}"
baseURL: "${https://weightsapi.com/v1}"
models:
default: ["Qwen/Qwen3-32B"]
fetch: false
titleConvo: false
modelDisplayLabel: "Qwen3 32B"
apiKey, baseURL y models.default son campos documentados de endpoint personalizado. fetch: false usa la lista explícita de modelos. Omitir provider usa el cliente compatible con OpenAI. titleConvo: false evita una llamada adicional de generación de título. Combine esto con el archivo existente, preservando la versión de configuración de nivel superior de la versión instalada.
Fuentes: Estructura del endpoint personalizado, instalación de la configuración.
Verificar la conexión#
Consulte la lista de modelos y luego envíe un mensaje corto. Una lista de modelos exitosa no demuestra soporte de herramientas, visión o esquema JSON. Verifique las capacidades del despliegue seleccionado antes de habilitarlas.