weightsapi.INFERENTIEConsole
Navigatie
Llama 3.1 405B versus DeepSeek V4 Flash

Llama 3.1 405B versus DeepSeek V4 Flash

Vergelijk de exacte implementatierevisies, gepubliceerde tarieven en contextlimieten.

Gegenereerd uit de modelcatalogus

Waarden hier, in de prijzen en in de machineleesbare feed gebruiken dezelfde modelrecords.

ModelInvoer / 1MUitvoer / 1MContextType
LLlama 3.1 405B$1.20$1.20128K*Tekst
DDeepSeek V4 Flash$0.09$0.18128K*Tekst

Llama 3.1 405B

Veeleisende algemene tekstgeneratie en complexe instructies.

Oorspronkelijke context
131.072 tokens
Kwantisering
Niet geverifieerd
Licentie
Llama 3.1 Community
Uitvoersnelheid
Nog geen metingen
Modeldetails lezen ↗

DeepSeek V4 Flash

Een tekstmodel voor redeneren met lange context, codering en toolworkflows, met een geconfigureerd venster van 1.048.576 tokens.

Gepubliceerde context
1.048.576 tokens
Kwantisering
Niet geverifieerd
Licentie
MIT
Uitvoersnelheid
Nog geen metingen
Modeldetails lezen ↗