weightsapi.INFERENZKonsole
Navigation
MODELLREFERENZ

DeepSeek V4 Flash

Ein Textmodell für Langkontext-Denken, Programmierung und Tool-Workflows, mit einem konfigurierten 1.048.576-Token-Fenster.

Kein KYC

Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.

Keine zusätzlichen Inhaltsfilter

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
GEMESSENE GESCHWINDIGKEITnicht gemessen

API-Modell-IDdeepseek-ai/DeepSeek-V4-Flash

Veröffentlichter Kontext1.048.576 Token

QuantisierungNicht verifiziert

LizenzMIT

Am besten für#

Langtextanalyse, Programmierung und Tool-Workflows, die eine Bewertung unterschiedlicher Denkbudgets rechtfertigen. DeepSeek veröffentlicht diesen Checkpoint als frühe Version mit Nicht-Denk- und Denkmodi. Prüfen Sie den Veröffentlichungsstatus und die Fähigkeiten des Herausgebers in der Modellkarte.

Wählen Sie ein anderes Modell, wenn#

Ihre Anwendung benötigt Bildeingabe oder einen Serving-Stack ohne DeepSeek-V4-Unterstützung. Dies ist ein Textmodell mit einem dedizierten Konversationskodierungsformat. Kodierungsreferenz.

Deployment-Details#

Die Konfiguration unterstützt 1.048.576 Positionen mit YaRN-Skalierung. Das Serving muss dessen Kodierung, Gewichte mit gemischter Präzision und Ausgabeparsing handhaben. Herausgeberspezifikationen sind getrennt von der WeightsAPI-Verfügbarkeit. Bestätigen Sie den Dienstkontext, die Serving-Präzision und unterstützte Modi für das ausgewählte Deployment.

Die gemeinsame Inferenz wird zu den auf dieser Seite angegebenen Eingabe- und Ausgabepreisen in USD pro Million Token abgerechnet. Dieselben Sätze gelten für das gesamte Service-Kontextfenster von WeightsAPI; auf diesen Standardtarif wird kein Cache- oder Batch-Rabatt gewährt. Bestätigen Sie den bereitgestellten Kontext, bevor Sie die aufgeführte Service-Obergrenze von 131.072 Token nutzen. Siehe Preisgestaltung und Dienststatus vor der Nutzung.

Lizenz und Herkunft#

Der genaue offizielle Checkpoint ist deepseek-ai/DeepSeek-V4-Flash. Sein Repository und die Gewichte werden unter der MIT-Lizenz veröffentlicht.

Dieses Modell aufrufen#

Bereiten Sie model: "deepseek-ai/DeepSeek-V4-Flash" mithilfe des Schnellstarts vor. Validieren Sie auf einem verfügbaren Deployment die Denkmodus-Einstellungen und das Tool-Parsing mit kurzen Eingaben, bevor Sie lange Kontexte verwenden.

Für den KI-Zugriff müssen Sie angemeldet sein und bereits eine bestätigte Aufladung von mindestens 100 USD vorgenommen haben. Danach muss das verfügbare Guthaben für die jeweilige Anfrage ausreichen. Veröffentlichte Preise aktivieren kein Modell: Prüfen Sie den Dienststatus, um die Verfügbarkeit der Bereitstellung festzustellen.

Anfragebeispiel

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'