Перед подключением#
Доступ к ИИ требует входа в систему, одного подтвержденного пополнения на сумму не менее 100 долларов США, авторизованного API-ключа и достаточного доступного кредита для запроса. Каждое последующее пополнение также имеет минимум 100 долларов США; меньшие остатки остаются пригодными для использования, если покрывают запрос. Кредит требует проверки транзакции. Проверьте статус сервиса для информации о доступности моделей перед отправкой трафика. Используйте собственный API-ключ без префикса Bearer в полях ключа. Базовый URL уже включает /v1. Эти конфигурации проверены по официальной документации, но не тестировались на реальном GPU-развертывании.
Конфигурация#
Настройте пользовательскую конечную точку в librechat.yaml; передайте её переменные окружения серверу LibreChat, смонтируйте эту конфигурацию там, где требуется, и перезапустите LibreChat.
endpoints:
custom:
- name: "Managed inference"
apiKey: "${WEIGHTSAPI_API_KEY}"
baseURL: "${https://weightsapi.com/v1}"
models:
default: ["Qwen/Qwen3-32B"]
fetch: false
titleConvo: false
modelDisplayLabel: "Qwen3 32B"
apiKey, baseURL и models.default — задокументированные поля пользовательской конечной точки. fetch: false использует явный список моделей. Если опустить provider, используется клиент, совместимый с OpenAI. titleConvo: false позволяет избежать дополнительного вызова генерации заголовка. Объедините это с существующим файлом, сохранив версию верхнеуровневой конфигурации установленной версии.
Источники: Структура пользовательской конечной точки, установка конфигурации.
Проверьте подключение#
Получите список моделей, затем отправьте одно короткое сообщение. Успешное получение списка моделей не доказывает поддержку инструментов, зрения или JSON Schema. Проверьте возможности выбранного развёртывания, прежде чем включать их.