weightsapi.INFERENZAConsole
Navigazione
RIFERIMENTO MODELLI

Qwen3 32B

Una scelta equilibrata per codice, chat multilingue e ragionamento.

Nessun KYC

Nessun caricamento di documenti d'identità o passaggio KYC nell'attuale procedura di accesso. L'accesso e l'utilizzo rimangono collegati al tuo account.

Nessun filtro contenuti aggiunto

WeightsAPI non aggiunge alcun filtro contenuti a livello di gateway. L'addestramento proprio del modello può comunque portarlo a rifiutare una richiesta.

INPUT / 1M$0.15
OUTPUT / 1M$0.20
SERVICE CONTEXT*128K
VELOCITÀ MISURATAnon misurato

ID modello APIQwen/Qwen3-32B

Contesto nativo32.768 token

QuantizzazioneNão verificado

LicenzaApache 2.0

Ideale per#

Una scelta equilibrata per codice, chat multilingue e ragionamento.

Scegli un altro modello quando#

Visione; i contesti lunghi richiedono la configurazione YaRN documentata.

Detalhes da implantação#

Use o ID exato do modelo e a fonte do editor mostrados acima. As taxas listadas do WeightsAPI se aplicam a tokens de entrada e saída. Confirme a disponibilidade da implantação, a precisão de serviço e o contexto antes de enviar tráfego; as especificações publicadas do modelo não estabelecem o desempenho do serviço. Verifique o status do serviço.

A janela nativa é de 32.768 tokens. O teto de serviço listado de 131.072 tokens requer uma configuração YaRN verificada; confirme o limite de contexto implantado antes de enviar entradas mais longas.

Licenza e provenienza#

Consulta la scheda modello ufficiale prima dell'implementazione. La licenza può imporre termini aggiuntivi. Pesi aperti non implicano licenze identiche.

Chiama questo modello#

Usa l'ID modello esatto mostrato sopra con l'endpoint Chat Completions. Il servizio non aggiunge un livello di filtraggio dei contenuti. Il comportamento del modello riflette comunque il suo addestramento originale.

Esempio di richiesta

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'