weightsapi.INFERENTIEConsole
Navigatie
MODELREFERENTIE

DeepSeek V4 Flash

Een tekstmodel voor redeneren met lange context, codering en toolworkflows, met een geconfigureerd venster van 1.048.576 tokens.

Geen KYC

Geen upload van identiteitsdocumenten of KYC-stap in het huidige aanmeldproces. Toegang en gebruik blijven gekoppeld aan uw account.

Geen toegevoegde inhoudsfilters

WeightsAPI voegt geen inhoudsfilter toe aan de gateway. De eigen training van een model kan er nog steeds toe leiden dat het een verzoek weigert.

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
GEMETEN SNELHEIDniet gemeten

API-model-IDdeepseek-ai/DeepSeek-V4-Flash

Gepubliceerde context1.048.576 tokens

KwantiseringNiet geverifieerd

LicentieMIT

Best voor#

Analyse van lange tekst, codering en toolworkflows die het evalueren van verschillende redeneerbudgetten rechtvaardigen. DeepSeek publiceert dit checkpoint als een vroege release met niet-denk- en redeneermodi. Controleer de releasestatus en mogelijkheden van de uitgever in de modelkaart.

Kies een ander model wanneer#

Uw toepassing beeldinvoer nodig heeft of een servingstack zonder DeepSeek-V4-ondersteuning. Dit is een tekstmodel met een speciaal gesprekscoderingsformaat. Coderingsreferentie.

Implementatiedetails#

De configuratie ondersteunt 1.048.576 posities met YaRN-schaling. Serving moet omgaan met de codering, mixed-precision-gewichten en uitvoerparsing. Uitgeversspecificaties staan los van WeightsAPI-beschikbaarheid. Bevestig de servicecontext, servingprecisie en ondersteunde modi voor de geselecteerde implementatie.

Gedeelde inferentie wordt gefactureerd tegen de input- en outputprijzen die op deze pagina worden weergegeven, in USD per miljoen tokens. Dezelfde tarieven gelden voor het gehele servicecontextvenster van WeightsAPI; er geldt geen cache- of batchkorting op dit standaardtarief. Controleer de daadwerkelijk ingestelde contextlimiet voordat u de vermelde servicelimiet van 131.072 tokens gebruikt. Zie prijzen en servicestatus vóór gebruik.

Licentie en herkomst#

Het exacte officiële checkpoint is deepseek-ai/DeepSeek-V4-Flash. De repository en gewichten zijn vrijgegeven onder de MIT-licentie.

Roep dit model aan#

Bereid model: "deepseek-ai/DeepSeek-V4-Flash" voor met behulp van de quickstart. Valideer op een beschikbare implementatie de instellingen voor de redeneermodus en toolparsing met korte invoer voordat u lange contexten gebruikt.

Voor AI-toegang moet u aangemeld zijn en al één bevestigde opwaardering van ten minste 100 USD hebben gedaan. Daarna is voldoende beschikbaar tegoed voor de betreffende aanvraag nodig. Gepubliceerde prijzen activeren geen model: controleer de servicestatus om te zien of de implementatie beschikbaar is.

Voorbeeldverzoek

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'