weightsapi.INFERÊNCIAConsole
Navegação
REFERÊNCIA DO MODELO

DeepSeek V4 Flash

Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho de ferramentas, com uma janela configurada de 1.048.576 tokens.

Sem KYC

Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.

Sem filtros de conteúdo adicionais

A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
VELOCIDADE MEDIDAnão medido

ID do modelo de APIdeepseek-ai/DeepSeek-V4-Flash

Contexto publicado1.048.576 tokens

QuantizaçãoNão verificado

LicençaMIT

Melhor para#

Análise de texto longo, codificação e fluxos de trabalho de ferramentas que justificam avaliar diferentes orçamentos de raciocínio. A DeepSeek publica este checkpoint como um lançamento antecipado com modos de não pensamento e raciocínio. Verifique o status de lançamento e as capacidades do editor no cartão do modelo.

Escolha outro modelo quando#

Sua aplicação precisa de entrada de imagem ou de uma pilha de serviço sem suporte ao DeepSeek-V4. Este é um modelo de texto com um formato de codificação de conversa dedicado. Referência de codificação.

Detalhes da implantação#

A configuração suporta 1.048.576 posições usando escalonamento YaRN. O serviço deve lidar com sua codificação, pesos de precisão mista e análise de saída. As especificações do editor são separadas da disponibilidade do WeightsAPI. Confirme o contexto do serviço, a precisão de serviço e os modos suportados para a implantação selecionada.

A inferência compartilhada é cobrada pelos preços de entrada e saída mostrados nesta página, em USD por milhão de tokens. As mesmas tarifas se aplicam em toda a janela de contexto do serviço WeightsAPI; nenhum desconto por cache ou processamento em lote se aplica a esta tarifa padrão. Confirme o contexto implantado antes de usar o teto de serviço listado de 131.072 tokens. Consulte preços e status do serviço antes do uso.

Licença e procedência#

O checkpoint oficial exato é deepseek-ai/DeepSeek-V4-Flash. Seu repositório e pesos são lançados sob a Licença MIT.

Chame este modelo#

Prepare model: "deepseek-ai/DeepSeek-V4-Flash" usando o guia de início rápido. Em uma implantação disponível, valide as configurações do modo de raciocínio e a análise de ferramentas com entradas curtas antes de usar contextos longos.

Para acessar a IA, é necessário fazer login e já ter uma primeira recarga confirmada de pelo menos 100 USD. Depois, basta ter saldo disponível suficiente para cada solicitação. Os preços publicados não ativam um modelo: consulte o status do serviço para verificar a disponibilidade da implantação.

Exemplo de solicitação

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'