Чат-завершения#
POST /v1/chat/completions принимает model и messages. У каждого сообщения есть role и content. Необязательные поля включают temperature, max_tokens, stream, tools, tool_choice и response_format, если развернутая модель их поддерживает. При успехе возвращаются id, object, choices и usage. Потоковая передача возвращает text/event-stream.
Устаревшие завершения#
POST /v1/completions принимает model и prompt. Поддерживается только тогда, когда серверный бэкенд обслуживания предоставляет режим завершения для запрошенной модели.
Эмбеддинги#
POST /v1/embeddings использует model и input. Подтвердите поддерживаемое развертывание эмбеддингов перед использованием этой конечной точки; недоступный сервис возвращает 503 service_unavailable. Проверьте статус сервиса на доступность.
Обнаружение моделей#
GET /v1/models перечисляет подключенные идентификаторы развертываний. Запись в каталоге описывает модель и ее тарифы; используйте обнаружение моделей и статус сервиса для проверки доступности.
Поля ответов#
Непоточные ответы включают usage.prompt_tokens и usage.completion_tokens. Поток SSE завершается авторитетной записью об использовании, за которой следует [DONE]. Ошибки провайдера нормализуются и не содержат внутренних учетных данных.
Вспомогательные сервисы#
Транскрипция аудио, генерация изображений, реранкинг и управляемая пакетная обработка требуют собственных поддерживаемых развертываний. Проверьте статус сервиса перед их использованием; недоступные операции возвращают service_unavailable. Указанный тариф не устанавливает активный сервис.
Пример запроса
curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true
}'