weightsapi.INFERÊNCIAConsole
Navegação
Llama 3.1 405B versus DeepSeek V4 Flash

Llama 3.1 405B versus DeepSeek V4 Flash

Compare as revisões exatas de implantação, as tarifas publicadas e os limites de contexto.

Gerado a partir do catálogo de modelos

Os valores aqui, na página de preços e no feed legível por máquina usam os mesmos registros de modelo.

ModeloEntrada / 1MSaída / 1MContextoTipo
LLlama 3.1 405B$1.20$1.20128K*Texto
DDeepSeek V4 Flash$0.09$0.18128K*Texto

Llama 3.1 405B

Geração de uso geral exigente e instruções complexas.

Contexto nativo
131.072 tokens
Quantização
Não verificado
Licença
Llama 3.1 Community
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗

DeepSeek V4 Flash

Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho de ferramentas, com uma janela configurada de 1.048.576 tokens.

Contexto publicado
1.048.576 tokens
Quantização
Não verificado
Licença
MIT
Velocidade de saída
Nenhuma medição ainda
Leia os detalhes do modelo ↗