Sohbet tamamlamaları#
POST /v1/chat/completions uç noktası model ve messages kabul eder. Her mesaj role ve content içerir. İsteğe bağlı alanlar; dağıtılan model bunları desteklediğinde temperature, max_tokens, stream, tools, tool_choice ve response_format içerir. Başarı; id, object, choices ve usage döndürür. Akış, text/event-stream döndürür.
Eski tamamlamalar#
POST /v1/completions uç noktası model ve prompt kabul eder. Yalnızca sunum arka ucu istenen model için tamamlama modunu sunduğunda desteklenir.
Gömme (embeddings)#
POST /v1/embeddings, model ve input kullanır. Bu uç noktayı kullanmadan önce desteklenen bir gömme dağıtımını onaylayın; kullanılamayan bir hizmet 503 service_unavailable döndürür. Kullanılabilirlik için hizmet durumunu kontrol edin.
Model keşfi#
GET /v1/models bağlı dağıtım kimliklerini listeler. Bir katalog girişi modeli ve ücretlerini açıklar; kullanılabilirliği kontrol etmek için model keşfi ve hizmet durumunu kullanın.
Yanıt alanları#
Akışsız yanıtlar usage.prompt_tokens ve usage.completion_tokens içerir. SSE, ardından [DONE] gelen yetkili bir kullanım kaydıyla sona erer. Sağlayıcı hataları normalleştirilir ve dahili kimlik bilgilerini içermez.
Yardımcı hizmetler#
Ses transkripsiyonu, görüntü üretimi, yeniden sıralama ve yönetilen toplu işleme kendi desteklenen dağıtımlarını gerektirir. Kullanmadan önce hizmet durumunu kontrol edin; kullanılamayan işlemler service_unavailable döndürür. Listelenen bir ücret aktif bir hizmeti kanıtlamaz.
İstek örneği
curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true
}'