weightsapi.ИНФЕРЕНЦИЯКонсоль
Навигация
Справочник API

Справочник API

Конечные точки, поля запросов и контракты ответов.

Чат-завершения#

POST /v1/chat/completions принимает model и messages. У каждого сообщения есть role и content. Необязательные поля включают temperature, max_tokens, stream, tools, tool_choice и response_format, если развернутая модель их поддерживает. При успехе возвращаются id, object, choices и usage. Потоковая передача возвращает text/event-stream.

Устаревшие завершения#

POST /v1/completions принимает model и prompt. Поддерживается только тогда, когда серверный бэкенд обслуживания предоставляет режим завершения для запрошенной модели.

Эмбеддинги#

POST /v1/embeddings использует model и input. Подтвердите поддерживаемое развертывание эмбеддингов перед использованием этой конечной точки; недоступный сервис возвращает 503 service_unavailable. Проверьте статус сервиса на доступность.

Обнаружение моделей#

GET /v1/models перечисляет подключенные идентификаторы развертываний. Запись в каталоге описывает модель и ее тарифы; используйте обнаружение моделей и статус сервиса для проверки доступности.

Поля ответов#

Непоточные ответы включают usage.prompt_tokens и usage.completion_tokens. Поток SSE завершается авторитетной записью об использовании, за которой следует [DONE]. Ошибки провайдера нормализуются и не содержат внутренних учетных данных.

Вспомогательные сервисы#

Транскрипция аудио, генерация изображений, реранкинг и управляемая пакетная обработка требуют собственных поддерживаемых развертываний. Проверьте статус сервиса перед их использованием; недоступные операции возвращают service_unavailable. Указанный тариф не устанавливает активный сервис.

Пример запроса

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'