weightsapi.INFÉRENCEConsole
Navigation
RÉFÉRENCE DU MODÈLE

DeepSeek V4 Flash

Un modèle de texte pour le raisonnement à long contexte, le codage et les flux de travail d'outils, avec une fenêtre configurée de 1 048 576 jetons.

Sans KYC

Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.

Sans filtre de contenu ajouté

WeightsAPI n’ajoute aucun filtre de contenu à sa passerelle API. L’entraînement propre au modèle peut toutefois l’amener à refuser une demande.

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
VITESSE MESURÉEnon mesuré

ID de modèle APIdeepseek-ai/DeepSeek-V4-Flash

Contexte publié1 048 576 jetons

QuantificationNon vérifié

LicenceMIT

Idéal pour#

L'analyse de textes longs, le codage et les flux de travail d'outils qui justifient l'évaluation de différents budgets de raisonnement. DeepSeek publie ce checkpoint comme une version précoce avec des modes non-pensée et raisonnement. Consultez le statut de publication et les capacités de l'éditeur dans la fiche modèle.

Choisissez un autre modèle quand#

Votre application nécessite une entrée image ou une pile de service sans support DeepSeek-V4. C'est un modèle texte avec un format d'encodage de conversation dédié. Référence d'encodage.

Détails du déploiement#

La configuration prend en charge 1 048 576 positions en utilisant la mise à l'échelle YaRN. La diffusion doit gérer son encodage, ses poids en précision mixte et l'analyse des sorties. Les spécifications de l'éditeur sont distinctes de la disponibilité de WeightsAPI. Confirmez le contexte de service, la précision de diffusion et les modes pris en charge pour le déploiement sélectionné.

L'inférence partagée est facturée aux tarifs d'entrée et de sortie indiqués sur cette page, en USD par million de tokens. Ces tarifs s'appliquent à toute la fenêtre de contexte du service WeightsAPI ; aucune remise liée au cache ou au traitement par lots ne s'applique à ce tarif standard. Confirmez la limite de contexte du déploiement avant d'utiliser le plafond annoncé de 131 072 tokens. Consultez les tarifs et l'état du service avant utilisation.

Licence et provenance#

Le checkpoint officiel exact est deepseek-ai/DeepSeek-V4-Flash. Son dépôt et ses poids sont publiés sous la licence MIT.

Appelez ce modèle#

Préparez model: "deepseek-ai/DeepSeek-V4-Flash" en utilisant le démarrage rapide. Sur un déploiement disponible, validez les paramètres du mode raisonnement et l'analyse des outils avec des entrées courtes avant d'utiliser de longs contextes.

Pour accéder à l'IA, connectez-vous à votre compte et effectuez un premier rechargement d'au moins 100 USD qui devra être confirmé. Il suffit ensuite de disposer du solde nécessaire pour la demande. Les tarifs publiés n'activent pas un modèle : consultez l'état du service pour vérifier la disponibilité du déploiement.

Exemple de demande

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'