Перед подключением#
Доступ к ИИ требует входа в систему, одного подтвержденного пополнения на сумму не менее 100 долларов США, авторизованного API-ключа и достаточного доступного кредита для запроса. Каждое последующее пополнение также имеет минимум 100 долларов США; меньшие остатки остаются пригодными для использования, если покрывают запрос. Кредит требует проверки транзакции. Проверьте статус сервиса для информации о доступности моделей перед отправкой трафика. Используйте собственный API-ключ без префикса Bearer в полях ключа. Базовый URL уже включает /v1. Эти конфигурации проверены по официальной документации, но не тестировались на реальном GPU-развертывании.
Конфигурация#
Добавьте модель в config.yaml Continue и введите конечную точку, API-ключ и точный идентификатор модели перед сохранением:
name: Managed inference
version: 1.0.0
schema: v1
models:
- name: Qwen3 32B
provider: openai
model: Qwen/Qwen3-32B
apiBase: https://weightsapi.com/v1
apiKey: WEIGHTSAPI_API_KEY
roles:
- chat
- edit
useResponsesApi: false
Точное поле — apiBase, а не baseURL. provider: openai задокументирован для совместимых провайдеров. Обычный Chat/Edit используйте как базовый рецепт; режим агента дополнительно зависит от нативной поддержки инструментов. Путь Qwen по умолчанию уже использует Chat Completions; явный useResponsesApi: false делает предполагаемую поверхность API ясной.
Источники: Конфигурация провайдера, совместимого с OpenAI, Справочник config.yaml.
Проверьте подключение#
Получите список моделей, затем отправьте одно короткое сообщение. Успешное получение списка моделей не доказывает поддержку инструментов, зрения или JSON Schema. Проверьте возможности выбранного развёртывания, прежде чем включать их.