weightsapi.INFERENCIAConsola
Navegación
REFERENCIA DEL MODELO

Qwen3 32B

Una opción equilibrada para código, chat multilingüe y razonamiento.

Sin KYC

No se requiere cargar documento de identidad ni realizar un paso KYC en el flujo de inicio de sesión actual. El acceso y el uso siguen vinculados a su cuenta.

Sin filtros de contenido añadidos

WeightsAPI no añade ningún filtro de contenido a nivel de puerta de enlace. El propio entrenamiento de un modelo puede hacer que rechace una solicitud.

INPUT / 1M$0.15
OUTPUT / 1M$0.20
SERVICE CONTEXT*128K
VELOCIDAD MEDIDAno medido

ID del modelo de APIQwen/Qwen3-32B

Contexto nativo32.768 tokens

CuantizaciónNão verificado

LicenciaApache 2.0

Mejor para#

Una opción equilibrada para código, chat multilingüe y razonamiento.

Elige otro modelo cuando#

Visión; los contextos largos requieren la configuración documentada de YaRN.

Detalhes da implantação#

Use o ID de modelo exato e a fonte do editor mostrados acima. As taxas WeightsAPI listadas se aplicam a tokens de entrada e saída. Confirme a disponibilidade da implantação, a precisão do serviço e o contexto antes de enviar tráfego; especificações de modelo publicadas não estabelecem desempenho do serviço. Verifique o status do serviço.

A janela nativa é de 32.768 tokens. O teto de serviço listado de 131.072 tokens requer uma configuração YaRN verificada; confirme o limite de contexto implantado antes de enviar entradas mais longas.

Licencia y procedencia#

Revisa la tarjeta de modelo oficial antes de la implementación. La licencia puede imponer términos adicionales. Los pesos abiertos no implican licencias idénticas.

Llama a este modelo#

Usa el ID de modelo exacto que se muestra arriba con el endpoint de Chat Completions. El servicio no añade una capa de filtrado de contenido. El comportamiento del modelo sigue reflejando su entrenamiento original.

Ejemplo de solicitud

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'