weightsapi.ИНФЕРЕНЦИЯКонсоль
Навигация
Continue.dev

Continue.dev

Настройте Continue.dev с конечной точкой WeightsAPI, совместимой с OpenAI.

Перед подключением#

Доступ к ИИ требует входа в систему, одного подтвержденного пополнения на сумму не менее 100 долларов США, авторизованного API-ключа и достаточного доступного кредита для запроса. Каждое последующее пополнение также имеет минимум 100 долларов США; меньшие остатки остаются пригодными для использования, если покрывают запрос. Кредит требует проверки транзакции. Проверьте статус сервиса для информации о доступности моделей перед отправкой трафика. Используйте собственный API-ключ без префикса Bearer в полях ключа. Базовый URL уже включает /v1. Эти конфигурации проверены по официальной документации, но не тестировались на реальном GPU-развертывании.

Конфигурация#

Добавьте модель в config.yaml Continue и введите конечную точку, API-ключ и точный идентификатор модели перед сохранением:

name: Managed inference
version: 1.0.0
schema: v1
models:
  - name: Qwen3 32B
    provider: openai
    model: Qwen/Qwen3-32B
    apiBase: https://weightsapi.com/v1
    apiKey: WEIGHTSAPI_API_KEY
    roles:
      - chat
      - edit
    useResponsesApi: false

Точное поле — apiBase, а не baseURL. provider: openai задокументирован для совместимых провайдеров. Обычный Chat/Edit используйте как базовый рецепт; режим агента дополнительно зависит от нативной поддержки инструментов. Путь Qwen по умолчанию уже использует Chat Completions; явный useResponsesApi: false делает предполагаемую поверхность API ясной.

Источники: Конфигурация провайдера, совместимого с OpenAI, Справочник config.yaml.

Проверьте подключение#

Получите список моделей, затем отправьте одно короткое сообщение. Успешное получение списка моделей не доказывает поддержку инструментов, зрения или JSON Schema. Проверьте возможности выбранного развёртывания, прежде чем включать их.