weightsapi.INFERÊNCIAConsole
Navegação
Qwen3 32B versus Llama 3.1 405B

Qwen3 32B versus Llama 3.1 405B

Compare as revisões exatas de implantação, as tarifas publicadas e os limites de contexto.

Gerado a partir do catálogo de modelos

Os valores aqui, na página de preços e no feed legível por máquina usam os mesmos registros de modelo.

ModeloEntrada / 1MSaída / 1MContextoTipo
QQwen3 32B$0.15$0.20128K*Texto
LLlama 3.1 405B$1.20$1.20128K*Texto

Qwen3 32B

Uma escolha equilibrada para código, chat multilíngue e raciocínio.

Contexto nativo
32.768 tokens
Quantização
Não verificado
Licença
Apache 2.0
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗

Llama 3.1 405B

Geração de uso geral exigente e instruções complexas.

Contexto nativo
131.072 tokens
Quantização
Não verificado
Licença
Llama 3.1 Community
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗