weightsapi.INFERENTIEConsole
Navigatie
Llama 3.1 8B versus Qwen3 32B

Llama 3.1 8B versus Qwen3 32B

Vergelijk de exacte implementatierevisies, gepubliceerde tarieven en contextlimieten.

Gegenereerd uit de modelcatalogus

Waarden hier, in de prijzen en in de machineleesbare feed gebruiken dezelfde modelrecords.

ModelInvoer / 1MUitvoer / 1MContextType
LLlama 3.1 8B$0.03$0.05128K*Tekst
QQwen3 32B$0.15$0.20128K*Tekst

Llama 3.1 8B

Snelle classificatie, extractie en lichtgewicht chat.

Oorspronkelijke context
131.072 tokens
Kwantisering
Niet geverifieerd
Licentie
Llama 3.1 Community
Uitvoersnelheid
Nog geen metingen
Modeldetails lezen ↗

Qwen3 32B

Een evenwichtige keuze voor code, meertalige chat en redeneren.

Oorspronkelijke context
32.768 tokens
Kwantisering
Niet geverifieerd
Licentie
Apache 2.0
Uitvoersnelheid
Nog geen metingen
Modeldetails lezen ↗