weightsapi.INFERÊNCIAConsole
Navegação
Llama 3.1 8B versus Qwen3 32B

Llama 3.1 8B versus Qwen3 32B

Compare as revisões exatas de implantação, as tarifas publicadas e os limites de contexto.

Gerado a partir do catálogo de modelos

Os valores aqui, na página de preços e no feed legível por máquina usam os mesmos registros de modelo.

ModeloEntrada / 1MSaída / 1MContextoTipo
LLlama 3.1 8B$0.03$0.05128K*Texto
QQwen3 32B$0.15$0.20128K*Texto

Llama 3.1 8B

Classificação rápida, extração e chat leve.

Contexto nativo
131.072 tokens
Quantização
Não verificado
Licença
Llama 3.1 Community
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗

Qwen3 32B

Uma escolha equilibrada para código, chat multilíngue e raciocínio.

Contexto nativo
32.768 tokens
Quantização
Não verificado
Licença
Apache 2.0
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗