weightsapi.INFERENZKonsole
Navigation
MODELLREFERENZ

Qwen3 32B

Eine ausgewogene Wahl für Code, mehrsprachigen Chat und logisches Denken.

Kein KYC

Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.

Keine zusätzlichen Inhaltsfilter

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.

INPUT / 1M$0.15
OUTPUT / 1M$0.20
SERVICE CONTEXT*128K
GEMESSENE GESCHWINDIGKEITnicht gemessen

API-Modell-IDQwen/Qwen3-32B

Nativer Kontext32.768 Token

QuantisierungNicht verifiziert

LizenzApache 2.0

Am besten geeignet für#

Eine ausgewogene Wahl für Code, mehrsprachigen Chat und logisches Denken.

Wählen Sie ein anderes Modell, wenn#

Bildverarbeitung; lange Kontexte erfordern die dokumentierte YaRN-Konfiguration.

Deployment-Details#

Verwenden Sie die oben gezeigte exakte Modell-ID und Herausgeberquelle. Die aufgeführten WeightsAPI-Raten gelten für Eingabe- und Ausgabetokens. Bestätigen Sie Deployment-Verfügbarkeit, Serving-Präzision und Kontext, bevor Sie Traffic senden; veröffentlichte Modellspezifikationen begründen keine Serviceleistung. Prüfen Sie den Servicestatus.

Das native Fenster beträgt 32.768 Tokens. Die aufgeführte 131.072-Token-Dienstobergrenze erfordert eine verifizierte YaRN-Konfiguration; bestätigen Sie die bereitgestellte Kontextgrenze, bevor Sie längere Eingaben senden.

Lizenz und Herkunft#

Lesen Sie die offizielle Modellkarte vor der Bereitstellung. Die Lizenz kann zusätzliche Bedingungen auferlegen. Offene Gewichte bedeuten nicht identische Lizenzen.

Dieses Modell aufrufen#

Verwenden Sie die oben gezeigte exakte Modell-ID mit dem Chat-Completions-Endpunkt. Der Dienst fügt keine Inhaltsfilterungsebene hinzu. Das Modellverhalten spiegelt weiterhin sein ursprüngliches Training wider.

Anfragebeispiel

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'