weightsapi.INFERENCJAKonsola
Nawigacja
REFERENCJA MODELU

Qwen3 32B

Zrównoważony wybór do kodu, wielojęzycznego czatu i rozumowania.

Bez KYC

W bieżącym procesie logowania nie ma przesyłania dokumentu tożsamości ani kroku KYC. Dostęp i korzystanie pozostają powiązane z Twoim kontem.

INPUT / 1M$0.15
OUTPUT / 1M$0.20
SERVICE CONTEXT*128K
ZMIERZONA PRĘDKOŚĆnie mierzono

ID modelu APIQwen/Qwen3-32B

Natywny kontekst32 768 tokeny

KwantyzacjaNiezweryfikowane

LicencjaApache 2.0

Najlepszy do#

Zrównoważony wybór do kodu, wielojęzycznego czatu i rozumowania.

Wybierz inny model, gdy#

Wizja; długie konteksty wymagają udokumentowanej konfiguracji YaRN.

Szczegóły wdrożenia#

Użyj dokładnego identyfikatora modelu i źródła wydawcy podanego powyżej. Wymienione stawki WeightsAPI dotyczą tokenów wejściowych i wyjściowych. Potwierdź dostępność wdrożenia, precyzję obsługi i kontekst przed wysłaniem ruchu; opublikowane specyfikacje modelu nie stanowią gwarancji wydajności usługi. Sprawdź status usługi.

Natywne okno to 32 768 tokenów. Wymieniony limit usługi 131 072 tokenów wymaga zweryfikowanej konfiguracji YaRN; potwierdź wdrożony limit kontekstu przed wysłaniem dłuższych danych wejściowych.

Licencja i pochodzenie#

Przed wdrożeniem zapoznaj się z oficjalną kartą modelu. Licencja może nakładać dodatkowe warunki. Otwarte wagi nie oznaczają identycznych licencji.

Wywołaj ten model#

Użyj dokładnego identyfikatora modelu podanego powyżej z endpointem Chat Completions. Usługa nie dodaje warstwy filtrowania treści. Zachowanie modelu nadal odzwierciedla jego oryginalne trenowanie.

Przykład żądania

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'