weightsapi.INFERENZAConsole
Navigazione
RIFERIMENTO MODELLI

DeepSeek V4 Flash

Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho com ferramentas, com uma janela configurada de 1.048.576 tokens.

Nessun KYC

Nessun caricamento di documenti d'identità o passaggio KYC nell'attuale procedura di accesso. L'accesso e l'utilizzo rimangono collegati al tuo account.

Nessun filtro contenuti aggiunto

WeightsAPI non aggiunge alcun filtro contenuti a livello di gateway. L'addestramento proprio del modello può comunque portarlo a rifiutare una richiesta.

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
VELOCITÀ MISURATAnon misurato

ID modello APIdeepseek-ai/DeepSeek-V4-Flash

Contesto pubblicato1.048.576 token

QuantizzazioneNão verificado

LicenzaMIT

Melhor para#

Análise de texto longo, codificação e fluxos de trabalho com ferramentas que justificam avaliar diferentes orçamentos de raciocínio. A DeepSeek publica este checkpoint como um lançamento antecipado com modos sem pensamento e de raciocínio. Verifique o status do lançamento e as capacidades do editor no cartão do modelo.

Scegli un altro modello quando#

La tua applicazione necessita di input di immagini o di uno stack di serving senza supporto DeepSeek-V4. Questo è un modello testuale con un formato di codifica conversazionale dedicato. Riferimento di codifica.

Detalhes da implantação#

A configuração suporta 1.048.576 posições usando escalonamento YaRN. O serviço deve lidar com sua codificação, pesos de precisão mista e análise de saída. As especificações do editor são separadas da disponibilidade do WeightsAPI. Confirme o contexto do serviço, a precisão de serviço e os modos suportados para a implantação selecionada.

L'inferenza condivisa viene fatturata ai prezzi di input e output mostrati in questa pagina, in USD per milione di token. Le stesse tariffe si applicano per tutta la finestra di contesto del servizio WeightsAPI; nessuno sconto per cache o batch si applica a questa tariffa standard. Confermare il contesto di distribuzione prima di utilizzare il tetto di servizio indicato di 131.072 token. Vedere prezzi e stato del servizio prima dell'uso.

Licenza e provenienza#

Il checkpoint ufficiale esatto è deepseek-ai/DeepSeek-V4-Flash. Il suo repository e i pesi sono rilasciati sotto la Licenza MIT.

Chame este modelo#

Prepare model: "deepseek-ai/DeepSeek-V4-Flash" usando o guia de início rápido. Em uma implantação disponível, valide as configurações do modo de raciocínio e a análise de ferramentas com entradas curtas antes de usar contextos longos.

Per usare l'IA devi accedere al tuo account e avere già una prima ricarica confermata di almeno 100 USD. Da quel momento è sufficiente disporre del credito necessario per la richiesta. I prezzi pubblicati non attivano un modello: controlla lo stato del servizio per verificare la disponibilità del modello nel deployment.

Esempio di richiesta

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'