weightsapi.INFERENTIEConsole
Navigatie
Geen KYC · Geen toegevoegde inhoudsfilters

Beheerde LLM-inferentie. Open modellen, één API.

Kies gepubliceerde open-weight-modellen via een OpenAI-compatibele API. Behoud vertrouwde tools, vergelijk tokenkosten en stem het model af op uw werklast.

Geen KYC

Geen upload van identiteitsdocumenten of KYC-stap in het huidige aanmeldproces. Toegang en gebruik blijven gekoppeld aan uw account.

Geen toegevoegde inhoudsfilters

WeightsAPI voegt geen inhoudsfilter toe aan de gateway. De eigen training van een model kan er nog steeds toe leiden dat het een verzoek weigert.

Geef vorm aan uw eerste verzoek.

Kies een catalogusmodel, schrijf een korte prompt en inspecteer de bijbehorende code. Houd het eerste voorbeeld eenvoudig, zodat het verzoek en het verwachte antwoord gemakkelijk te controleren zijn.

Accounttoegang Meld u aan en bevestig een opwaardering van ten minste USD 100 en besteed vervolgens uw vooruitbetaalde krediet. Elke opwaardering heeft hetzelfde minimum; kleinere resterende saldi blijven bruikbaar. Controleer de servicestatus op modelbeschikbaarheid.

PlaygroundGefinancierde account vereist
128K context*
Accounttoegang controleren…
Promptinhoud wordt niet opgeslagen door deze gateway.
ReactieGereed wanneer account-, sleutel- en servicecontroles slagen

Controleer de toegang vóór uw eerste verzoek

Meld u aan, bevestig een opwaardering van ten minste USD 100 en selecteer een API-sleutel om uw eerste verzoek te verzenden.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
Hetzelfde verzoek, in uw applicatie.Lees de quickstart

* Servicecontext. Zie de modelpagina voor het oorspronkelijke venster en de configuratievereisten.

Bouw rond uw applicatie

Begin met een nuttige taak.

Het kookboek geeft u kleine voorbeelden om aan te passen, waarbij de applicatie de controle behoudt.

Conversatie-assistenten

Bouw een gesprekslus, beheer de berichtgeschiedenis en valideer de antwoorden die uw gebruikers ontvangen. Begin met een terminalvoorbeeld voordat u een gebruikersinterface toevoegt.

Chatbot-recept

Programmeren en tools

Verken een tool-calling-lus met een expliciete allowlist en argumentcontroles. De ondersteuning van model en deployment moet worden geverifieerd voordat u acties inschakelt.

Tool-calling-recept

Antwoorden uit documenten

Breng uw eigen retriever mee, lever geselecteerde passages aan en verifieer de citaten. Het voorbeeld gebruikt eenvoudige tekstmatching; de embeddings-service is niet beschikbaar.

Documentrecept
Use cases
Een praktisch startpunt

Plan uw eerste workflow.

Bepaal wat uw applicatie nodig heeft voordat u het verkeer verhoogt of meer functies toevoegt.

  1. Kies voor de taak

    Vergelijk mogelijkheden, modellicenties, context en invoer-/uitvoertarieven. Controleer de servicestatus en de bevestigde implementatielimieten voordat u aanvragen naar een model routeert.

    Vergelijk modellen
  2. Bereid een klein verzoek voor

    Gebruik het chat-completions-formaat met een exacte model-ID en een begrensde uitvoer. Lees de streaming- en foutengidsen voordat u retries of tools toevoegt.

    Open de quickstart
  3. Houd het verbruik begrijpelijk

    Scheid applicaties met aparte sleutels en uitgavenplafonds. De console is de plek om verbruik en beschikbaar tegoed te bekijken, inclusief bedragen die zijn gereserveerd voor lopende verzoeken.

    Verken de console
Hoe het werkt
Modelcatalogus

Kies de juiste afweging.

Vergelijk de gepubliceerde keuzes hieronder en open vervolgens een modelpagina voor de mogelijkheden, licentie en deploymentnotities. Prijs alleen zegt niets over kwaliteit of snelheid.

ModelInvoerUitvoerServicecontext
LLlama 3.1 8BUS$ 0,03US$ 0,05131.072
QQwen3 32BUS$ 0,15US$ 0,20131.072
DDeepSeek V3US$ 0,25US$ 0,85131.072
DDeepSeek R1US$ 0,50US$ 2,15131.072

Invoer- en uitvoertarieven zijn in USD per miljoen tokens. Servicelimieten voor context vereisen implementatiebevestiging; model-native limieten zijn afzonderlijk.

Uw bestaande tools

Breng uw bestaande tools mee.

Verbind vertrouwde tools met hun gedocumenteerde instellingen. Valideer de functies die uw applicatie nodig heeft op de geselecteerde implementatie voordat u verkeer verplaatst.

Blader door alle integraties
Ken de grenzen

Begrijp de servicegrenzen.

Bekijk accountcontroles, gegevensverwerking en implementatievereisten voordat u een model kiest.

Een gedefinieerde datagrens

De gateway slaat prompts of responsen niet op. Retentie door de provider en infrastructuurlogboekregistratie moeten nog worden geverifieerd; dit is geen end-to-end retentiegarantie.

Lees het vertrouwensoverzicht

Tarieven die u kunt inspecteren

Vergelijk invoer en uitvoer afzonderlijk en maak een schatting met uw eigen werklast. Toegewijde capaciteit volgt een ander reserveringsmodel.

Verken prijzen

Een pad door problemen

Gebruik de ondersteuningsgids om fouten te diagnosticeren en een rapport voor te bereiden. Controleer de servicestatus op beschikbaarheid en monitoringinformatie.

Open de ondersteuningsgids
Over
Voordat u begint

Vragen voordat u begint.

Begrijp beschikbaarheid, compatibiliteit, kosten en gegevensverwerking voordat u ze in uw applicatie integreert.

Moet ik KYC voltooien?

Het huidige aanmeldproces heeft geen upload van identiteitsdocumenten of KYC-verificatiestap. Een aangemeld account is nog steeds vereist en het gebruik blijft aan dat account gekoppeld.

Lees meer

Zijn de modellen ongecensureerd?

WeightsAPI voegt geen inhoudsfilter toe aan de gateway. De catalogus bevat originele modellen en door hun respectievelijke makers gepubliceerde fijn afgestelde varianten, waaronder Dolphin en Hermes. Sommige varianten zijn ontworpen om weigeringen te verminderen; modeltraining kan nog steeds weigeringen veroorzaken. Lees de bron- en gedragsnotities van elk model.

Lees meer

Wat kan ik vandaag gebruiken?

Beheer API-sleutels, maak crypto-financieringsorders aan en plaats toegewijde GPU-orders. Controleer de servicestatus voor modelbeschikbaarheid; betalingskrediet en GPU-activering vereisen bevestiging.

Lees meer

Wat betekent OpenAI-compatibel hier?

De API gebruikt Chat Completions, legacy Completions en modeldetectieroutes. Controleer de mogelijkheden van de geselecteerde implementatie; provider-specifieke API's zijn niet uitwisselbaar.

Lees meer

Hoe wordt een modelverzoek geprijsd?

Kosten gebruiken afzonderlijke modeltarieven voor werkelijke invoer- en uitvoertokens, verrekend op basis van door de provider bevestigd gebruik na een initiële kredietreservering.

Lees meer

Slaat WeightsAPI mijn prompts of modelantwoorden op?

De gateway bewaart prompts of antwoorden niet in de toepassingsdatabase. Accountrecords blijven bestaan en het bewaarbeleid van providers vereist afzonderlijke verificatie.

Lees meer
Lees de volledige FAQ

Kies een model. Maak het eerste verzoek duidelijk.

Begin met de catalogus en een klein voorbeeld. De documentatie legt het verzoekformaat uit; de FAQ helpt bij het oplossen van de beslissingen eromheen.