weightsapi.INFERENZKonsole
Navigation
Kein KYC · Keine zusätzlichen Inhaltsfilter

Managed LLM-Inferenz. Offene Modelle, eine API.

Wählen Sie veröffentlichte Open-Weight-Modelle über eine OpenAI-kompatible API. Behalten Sie vertraute Tools, vergleichen Sie Tokenkosten und stimmen Sie das Modell auf Ihre Arbeitslast ab.

Kein KYC

Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.

Keine zusätzlichen Inhaltsfilter

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.

Gestalten Sie Ihre erste Anfrage.

Wählen Sie ein Katalogmodell, schreiben Sie einen kleinen Prompt und prüfen Sie den passenden Code. Halten Sie das erste Beispiel einfach, damit Anfrage und erwartete Antwort leicht zu überprüfen sind.

Kontozugriff Melden Sie sich an und bestätigen Sie eine Aufladung von mindestens USD 100, dann geben Sie Ihr Prepaid-Guthaben aus. Jede Aufladung hat dasselbe Minimum; kleinere Restguthaben bleiben nutzbar. Prüfen Sie den Servicestatus auf Modellverfügbarkeit.

PlaygroundAufgeladenes Konto erforderlich
128K Kontext*
Kontozugriff wird geprüft …
Prompt-Inhalte werden von diesem Gateway nicht gespeichert.
AntwortBereit, wenn Konto-, Schlüssel- und Dienstprüfungen erfolgreich sind

Prüfen Sie den Zugriff vor Ihrer ersten Anfrage

Melden Sie sich an, bestätigen Sie eine Aufladung von mindestens 100 USD und wählen Sie einen API-Schlüssel, um Ihre erste Anfrage zu senden.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
Dieselbe Anfrage, in Ihrer Anwendung.Schnellstart lesen

* Dienstkontext. Siehe Modellseite für das native Fenster und die Konfigurationsanforderungen.

Entwickeln Sie rund um Ihre Anwendung

Beginnen Sie mit einer nützlichen Aufgabe.

Das Kochbuch bietet Ihnen kleine Beispiele zum Anpassen, wobei die Anwendung weiterhin die Kontrolle behält.

Konversationsassistenten

Erstellen Sie eine Konversationsschleife, verwalten Sie den Nachrichtenverlauf und validieren Sie die Antworten, die Ihre Nutzer erhalten. Beginnen Sie mit einem Terminalbeispiel, bevor Sie eine Benutzeroberfläche hinzufügen.

Chatbot-Rezept

Programmierung und Tools

Erkunden Sie eine Tool-Calling-Schleife mit einer expliziten Zulassungsliste und Argumentprüfungen. Die Unterstützung durch Modell und Bereitstellung muss überprüft werden, bevor Aktionen aktiviert werden.

Tool-Calling-Rezept

Antworten aus Dokumenten

Bringen Sie Ihren eigenen Retriever mit, liefern Sie ausgewählte Passagen und überprüfen Sie die Zitate. Das Beispiel verwendet einfachen Textabgleich; der Embeddings-Dienst ist nicht verfügbar.

Dokumenten-Rezept
Anwendungsfälle
Ein praktischer Ausgangspunkt

Planen Sie Ihren ersten Workflow.

Entscheiden Sie, was Ihre Anwendung benötigt, bevor Sie den Datenverkehr erhöhen oder weitere Funktionen hinzufügen.

  1. Wählen Sie für die Aufgabe

    Vergleichen Sie Fähigkeiten, Modelllizenzen, Kontext und Ein-/Ausgaberaten. Prüfen Sie den Servicestatus und die bestätigten Deployment-Grenzen, bevor Sie Anfragen an ein Modell leiten.

    Modelle vergleichen
  2. Bereiten Sie eine kleine Anfrage vor

    Verwenden Sie das Chat-Completions-Format mit einer exakten Modell-ID und einer begrenzten Ausgabe. Lesen Sie die Streaming- und Fehlerleitfäden, bevor Sie Wiederholungen oder Tools hinzufügen.

    Schnellstart öffnen
  3. Halten Sie die Nutzung verständlich

    Trennen Sie Anwendungen durch unterschiedliche Schlüssel und Ausgabenobergrenzen. Die Konsole ist der Ort, um Nutzung und verfügbares Guthaben zu prüfen, einschließlich der für ausstehende Anfragen reservierten Beträge.

    Konsole entdecken
So funktioniert es
Modellkatalog

Wählen Sie den richtigen Kompromiss.

Vergleichen Sie die unten veröffentlichten Optionen und öffnen Sie dann eine Modellseite für deren Funktionen, Lizenz und Bereitstellungshinweise. Der Preis allein bestimmt weder Qualität noch Geschwindigkeit.

ModellEingabeAusgabeDienstkontext
LLlama 3.1 8B0,03 $0,05 $131.072
QQwen3 32B0,15 $0,20 $131.072
DDeepSeek V30,25 $0,85 $131.072
DDeepSeek R10,50 $2,15 $131.072

Ein- und Ausgaberaten sind in USD pro Million Tokens. Dienst-Kontextgrenzen erfordern eine Deployment-Bestätigung; modellnative Grenzen sind separat.

Ihre vorhandenen Tools

Bringen Sie Ihre vorhandenen Werkzeuge mit.

Verbinden Sie vertraute Werkzeuge über ihre dokumentierten Einstellungen. Validieren Sie die benötigten Funktionen Ihrer Anwendung auf dem ausgewählten Deployment, bevor Sie Traffic verlagern.

Alle Integrationen durchsuchen
Kennen Sie die Grenzen

Verstehen Sie die Dienstgrenzen.

Überprüfen Sie Kontosteuerung, Datenverarbeitung und Deployment-Anforderungen, bevor Sie ein Modell wählen.

Eine definierte Datengrenze

Das Gateway speichert keine Prompts oder Antworten dauerhaft. Die Aufbewahrung durch den Anbieter und das Infrastruktur-Logging müssen noch überprüft werden; dies ist keine Ende-zu-Ende-Aufbewahrungsgarantie.

Lesen Sie die Vertrauensübersicht

Preise, die Sie einsehen können

Vergleichen Sie Eingabe und Ausgabe getrennt und schätzen Sie mit Ihrer eigenen Arbeitslast. Dedizierte Kapazität folgt einem anderen Reservierungsmodell.

Preise entdecken

Ein Weg durch Probleme

Nutzen Sie den Support-Leitfaden, um Fehler zu diagnostizieren und einen Bericht vorzubereiten. Prüfen Sie den Servicestatus auf Verfügbarkeit und Überwachungsinformationen.

Support-Leitfaden öffnen
Über
Bevor Sie beginnen

Fragen, bevor Sie beginnen.

Verstehen Sie Verfügbarkeit, Kompatibilität, Kosten und Datenverarbeitung, bevor Sie sie in Ihre Anwendung einbauen.

Muss ich KYC abschließen?

Der aktuelle Anmeldevorgang beinhaltet kein Hochladen von Ausweisdokumenten oder einen KYC-Verifizierungsschritt. Ein angemeldetes Konto ist dennoch erforderlich, und die Nutzung bleibt mit diesem Konto verknüpft.

Weiterlesen

Sind die Modelle unzensiert?

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Der Katalog umfasst Originalmodelle und von ihren jeweiligen Erstellern veröffentlichte feinabgestimmte Varianten, einschließlich Dolphin und Hermes. Einige Varianten sind darauf ausgelegt, Ablehnungen zu reduzieren; das Modelltraining kann dennoch Ablehnungen verursachen. Lesen Sie die Quellen- und Verhaltenshinweise jedes Modells.

Weiterlesen

Was kann ich heute nutzen?

API-Schlüssel verwalten, Krypto-Einzahlungsaufträge erstellen und dedizierte GPU-Bestellungen aufgeben. Prüfe den Dienststatus für Modellverfügbarkeit; Zahlungsguthaben und GPU-Aktivierung erfordern eine Bestätigung.

Weiterlesen

Was bedeutet OpenAI-kompatibel hier?

Die API verwendet Chat Completions, Legacy Completions und Modellerkennungsrouten. Prüfe die Fähigkeiten des gewählten Deployments; anbieterspezifische APIs sind nicht austauschbar.

Weiterlesen

Wie wird eine Modellanfrage bepreist?

Die Kosten verwenden getrennte Modellraten für tatsächliche Eingabe- und Ausgabetokens, die nach einer anfänglichen Kreditreservierung aus der vom Anbieter bestätigten Nutzung abgerechnet werden.

Weiterlesen

Speichert WeightsAPI meine Prompts oder Modellantworten?

Das Gateway speichert Prompts oder Antworten nicht in seiner Anwendungsdatenbank. Kontodatensätze bleiben bestehen, und die Anbieteraufbewahrung erfordert eine separate Überprüfung.

Weiterlesen
Lesen Sie die vollständige FAQ

Wählen Sie ein Modell. Machen Sie die erste Anfrage klar.

Beginnen Sie mit dem Katalog und einem kleinen Beispiel. Die Dokumentation erklärt das Anfrageformat; die FAQ hilft, die damit verbundenen Entscheidungen zu klären.