weightsapi.INFERENZKonsole
Navigation
FAQ

Häufig gestellte Fragen

Praktische Antworten zu WeightsAPI-Zugriff, API-Integration, Krypto-Guthaben, Abrechnung und Datenverarbeitung.

Auf einen Blick

Klare Antworten zu Zugang, Modellen, Kosten, Daten und Dienstverfügbarkeit.

Erste Schritte

Verstehen Sie, was heute verfügbar ist, und bereiten Sie Ihre erste Integration vor.

Was kann ich heute nutzen?

API-Schlüssel verwalten, Krypto-Einzahlungsaufträge erstellen und dedizierte GPU-Bestellungen aufgeben. Prüfe den Dienststatus für Modellverfügbarkeit; Zahlungsguthaben und GPU-Aktivierung erfordern eine Bestätigung.

Durchsuche den Modellkatalog und die Dokumentation, melde dich in der Konsole an und erstelle oder widerrufe API-Schlüssel. Der Krypto-Checkout liefert Betrag, Netzwerk, Adresse und Zahlungsfrist; Guthaben erfordert eine verifizierte Transaktion. Dedizierte Bestellungen können aufgegeben und aus bestätigtem Guthaben bezahlt werden, die Hardware wird nach Bereitstellung aktiviert. Prüfe den Status und den Schnellstart, bevor du Modellanfragen sendest.

Melde dich an und bestätige eine Einzahlung von mindestens 100 USD, bevor du KI nutzt. Jede spätere Einzahlung hat denselben Mindestbetrag; nach der Qualifizierung bleibt ein kleineres Restguthaben nutzbar, wenn es die Anfrage abdeckt. Schlüsselberechtigungen, Ausgabenlimits und Modellverfügbarkeit gelten weiterhin. Ausstehende Zahlungen schalten den Zugriff nicht frei. Prüfe den Dienststatus, bevor du Anfragen sendest.

Muss ich KYC abschließen?

Der aktuelle Anmeldevorgang beinhaltet kein Hochladen von Ausweisdokumenten oder einen KYC-Verifizierungsschritt. Ein angemeldetes Konto ist dennoch erforderlich, und die Nutzung bleibt mit diesem Konto verknüpft.

Wie erstelle ich ein Konto und einen API-Schlüssel?

Melde dich in der Konsole an, erstelle einen Schlüssel mit Ausgaben- und Modellkontrollen und kopiere sein Geheimnis sofort, da es nur einmal angezeigt wird.

Melde dich in der Konsole an und erstelle einen benannten Schlüssel mit einem positiven Ausgabenlimit und, falls nützlich, einer Liste erlaubter Modelle. Kopiere das Geheimnis, wenn es erscheint: Die Konsole zeigt es nur bei der Erstellung an. Bewahre es in einer serverseitigen Umgebungsvariablen oder einem Secret-Manager auf. Schlüssel kontrollieren den Zugriff; verfügbares Guthaben und ein verfügbares Modell sind ebenfalls erforderlich. Siehe Authentifizierung.

Was benötige ich für meine erste erfolgreiche Anfrage?

Verwende ein verfügbares Modell, einen autorisierten Schlüssel und ausreichend bestätigtes Guthaben. Wähle eine exakte Modell-ID und halte die Ausgabe innerhalb der Grenzen des Deployments.

Verwende die Basis-URL im Schnellstart, sende deinen API-Schlüssel als Bearer-Token und wähle eine exakte Modell-ID, die von /v1/models zurückgegeben wird. Setze ein Ausgabetoken-Limit, das zu deinem Budget und dem Kontextfenster des Deployments passt. Prüfe den Dienststatus, bevor du Anfragen einreichst.

Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Einzahlung von mindestens 100 USD, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Einzahlung hat ebenfalls ein Minimum von 100 USD; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Guthaben erfordert eine Transaktionsverifizierung. Prüfe den Dienststatus auf Modellverfügbarkeit, bevor du Traffic sendest.

Kann ich eine bestehende OpenAI- oder Anthropic-Integration wiederverwenden?

OpenAI Chat Completions benötigt eine neue Basis-URL, einen Schlüssel und ein Modell; Anthropic erfordert zusätzlich Änderungen an SDK, Nachrichtenformat und Antwortparsing.

Bei einer OpenAI-Chat-Completions-Integration sind die Hauptänderungen die Basis-URL, der API-Schlüssel und die Modell-ID. Anbieterspezifische APIs und Funktionen erfordern separate Prüfungen. Eine Anthropic-Integration benötigt außerdem Änderungen am SDK, am Nachrichtenformat, an der Platzierung des System-Prompts und am Antwortparsing. Folgen Sie dem Migrationsleitfaden und testen Sie dann repräsentative Prompts, Tools und strukturierte Ausgaben gegen eine verbundene Bereitstellung, bevor Sie Traffic umleiten. Kompatibilität mit einem vertrauten Anfrageformat garantiert kein identisches Modellverhalten.

Wie sollte ich ein Modell auswählen?

Bewerte das kleinste geeignete Modell anhand deiner eigenen Aufgaben und überprüfe dann seine Verfügbarkeit, Kontextgrenzen und die erforderliche Tool- oder Schemaunterstützung.

Beginne mit der Aufgabe: kurzer interaktiver Chat, Programmierung, Schlussfolgern oder längere Dokumenteneingabe. Vergleiche die Modellseiten auf Herausgeberspezifikationen, Dienstkontext und Eingabe-/Ausgaberaten. Prüfe die Modellverfügbarkeit und bewerte den kleinsten geeigneten Kandidaten anhand deiner eigenen Aufgaben. Überprüfe die Tool-Aufruf- oder Schemaunterstützung separat, bevor du eine Anwendung auf ein Modell festlegst.

Modelle und API-Funktionen

Prüfen Sie den Umfang der Kompatibilität und die Anforderungen jeder Funktion.

Sind die Modelle unzensiert?

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Der Katalog umfasst Originalmodelle und von ihren jeweiligen Erstellern veröffentlichte feinabgestimmte Varianten, einschließlich Dolphin und Hermes. Einige Varianten sind darauf ausgelegt, Ablehnungen zu reduzieren; das Modelltraining kann dennoch Ablehnungen verursachen. Lesen Sie die Quellen- und Verhaltenshinweise jedes Modells.

Was bedeutet OpenAI-kompatibel hier?

Die API verwendet Chat Completions, Legacy Completions und Modellerkennungsrouten. Prüfe die Fähigkeiten des gewählten Deployments; anbieterspezifische APIs sind nicht austauschbar.

WeightsAPI akzeptiert die Anfrageformate Chat Completions, Legacy Completions und Modellerkennung. Die Generierung erfordert ein verfügbares Deployment, das den gewählten Vorgang unterstützt. Responses, Assistants und anbieterspezifische Tools sind keine Drop-in-Ersatz. Konsultiere die API-Referenz für unterstützte Vorgänge und validiere dann die von deiner Anwendung genutzten Funktionen, bevor du Traffic umstellst.

Unterstützt die API gestreamte Antworten?

Verwende Server-Sent Events für gestreamte Chat-Antworten auf einem verfügbaren Deployment und behalte den endgültigen Nutzungsdatensatz für die Abrechnung.

Setze stream: true für ein verfügbares Chat-Deployment und konsumiere vollständige Server-Sent Events. Ein Netzwerk-Chunk ist nicht unbedingt eine Nachricht, und der endgültige Nutzungsdatensatz kann nach dem Ende des Antworttextes eintreffen. Behalte den API-Schlüssel auf deinem Server, wenn du einen Stream an einen Browser weiterleitest. Der Streaming-Leitfaden behandelt Nutzung und unterbrochene Verbindungen; prüfe den Dienststatus auf Verfügbarkeit.

Kann ein Modell Tools aufrufen oder Aktionen für meine Anwendung ausführen?

Deine Anwendung validiert und führt Tool-Aufrufe aus. Das gewählte Modell und Deployment müssen das Tool-Format unterstützen, bevor Aktionen aktiviert werden können.

Das Gateway leitet Tool-Definitionen an das gewählte Modell weiter. Ein Modell kann einen angeforderten Tool-Namen und Argumente zurückgeben; deine Anwendung entscheidet, ob die Aktion ausgeführt wird. Validiere beides gegen eine Positivliste und die Berechtigungen des aktuellen Benutzers und gib das Ergebnis dann im Gespräch zurück. WeightsAPI führt die Tools deiner Anwendung nicht aus. Prüfe die Deployment-Unterstützung und folge Funktionsaufruf, bevor du Aktionen aktivierst.

Kann ich verlangen, dass eine Antwort einem JSON-Schema entspricht?

Striktes JSON erfordert ein Deployment mit kompatibler eingeschränkter Dekodierung. Validiere jede Antwort gegen dein Schema und behandle ungültige oder unvollständige Ausgaben.

Strikte Schemaausgabe erfordert eingeschränkte Dekodierung und Unterstützung für dein Schema im gewählten Deployment. Ein Modell aufzufordern, „JSON zurückzugeben“, garantiert allein keine Schemaübereinstimmung. Das Gateway leitet response_format weiter; bestätige die Strict-Mode-Unterstützung für das Deployment, bevor du dich darauf verlässt. Folge dem Leitfaden für strukturierte Ausgabe, validiere jedes Ergebnis mit demselben Schema und behandle Trunkierung oder Ablehnung explizit.

Sind Embeddings-, Batch-, Audio- und Bilddienste verfügbar?

Prüfe die API-Referenz und den Dienststatus, bevor du Embeddings, Reranking, verwaltete Batch-Verarbeitung, Audiotranskription oder Bildgenerierung verwendest.

Diese Vorgänge benötigen ihr eigenes unterstütztes Deployment. Eine aufgeführte Fähigkeit oder Rate begründet keinen aktiven Endpunkt, und das Senden mehrerer Chat-Anfragen von deiner Anwendung unterscheidet sich von einer verwalteten Batch-API. Prüfe die API-Referenz und den Dienststatus, bevor du einen Zusatzdienst einplanst.

Krypto-Einzahlungen

Lesen Sie den genauen Asset-, Netzwerk- und Zahlungsstatus, bevor Sie Geld senden.

Welche Kryptowährungen und Netzwerke kann ich verwenden?

Verwende die im aktuellen Zahlungskonfiguration angezeigten Asset- und Netzwerkoptionen; eine angezeigte Empfangsadresse begründet kein bestätigtes Guthaben.

Wähle das exakte Asset und Netzwerk, das im Checkout angezeigt wird, und verwende die mit deiner Bestellung gespeicherte Empfangsadresse. Ein Token in einem anderen Netzwerk ist nicht austauschbar. Die Bestellung behält ihr Asset, Netzwerk und Adresse, auch wenn sich die Zahlungskonfiguration ändert. Guthaben erscheint erst, nachdem die eingehende Transaktion abgeglichen und verifiziert wurde. Siehe Abrechnung.

Wie füge ich Krypto-Guthaben hinzu?

Der Checkout berechnet den Krypto-Betrag für deine USD-Einzahlung und zeigt die feste Empfangsadresse, das Netzwerk, den Wechselkurs und die Zahlungsfrist an.

Erstelle einen Einzahlungsauftrag über mindestens 100 USD. Der Server ermittelt einen aktuellen Marktkurs und legt den zu sendenden Betrag für 10 Minuten fest, einschließlich für USDT und USDC. Behalte die Auftragsreferenz und zahle Netzwerkgebühren separat. Transaktionsabgleich und Guthabenbestätigung bleiben getrennte verifizierte Schritte; das Erstellen eines Auftrags oder das Aktualisieren seines Status fügt kein Guthaben hinzu. Siehe den Abrechnungsleitfaden.

Warum könnte eine Einzahlung ausstehend bleiben?

Ein Auftrag bleibt ausstehend, bis seine Überweisung abgeglichen, verifiziert und gutgeschrieben ist. Das Starten einer Zahlung oder das Aktualisieren seines Status bestätigt ihn nicht.

Ein Auftrag beginnt in einem Zustand des Wartens auf Bestätigung. Seine Überweisung muss abgeglichen und verifiziert werden, bevor Kontoguthaben verbucht wird. Eine Zahlungserklärung oder Statusaktualisierung kann ihn nicht als bezahlt markieren. Behalte die Auftragsreferenz und die öffentliche Transaktionskennung und sende keine weitere Zahlung, nur weil die erste ausstehend ist. Der Support-Leitfaden listet die aufzubewahrenden Details auf; Bestätigungs- und Lösungszeiten sind nicht garantiert.

Was passiert, wenn ich das falsche Asset sende oder das falsche Netzwerk verwende?

Wiederherstellung und Rückerstattungen für Übertragungen mit falschem Asset oder falschem Netzwerk sind nicht etabliert; verwenden Sie das exakte Ziel, das in Ihrem Finanzierungsauftrag erfasst ist.

Eine Wiederherstellungsrichtlinie für Übertragungen mit falschem Netzwerk oder falschem Asset wurde nicht etabliert. Gehen Sie nicht davon aus, dass eine Übertragung gutgeschrieben, wiederhergestellt oder erstattet werden kann. Überprüfen Sie vor dem Senden das Asset, das Netzwerk, die Adresse und den Betrag anhand der aktuellen Einzahlungsanweisungen. Wenn ein Übertragungsproblem auftritt, geben Sie die Auftragsreferenz und die öffentliche Transaktionskennung über den Support an; teilen Sie niemals eine Wallet-Seed-Phrase oder einen privaten Schlüssel.

Wie wird der Krypto-Betrag berechnet und wann läuft er ab?

Das USD-Ziel wird zu einem aktuellen Marktkurs umgerechnet. Der Krypto-Betrag wird auf die kleinste Einheit des Assets aufgerundet und für 10 Minuten fixiert.

Checkout zeigt die Kursquelle, den Kurszeitstempel und die Zahlungsfrist an. USDT und USDC verwenden ihre tatsächlichen Marktkurse, nicht eine angenommene Eins-zu-eins-Parität. Wenn kein aktueller Kurs verfügbar ist, wiederholen Sie die Berechnung, bevor Sie Geld senden. Eine bestehende Bestellung ohne Angebot kann eines erhalten, ohne ihre Referenz oder Adresse zu ändern.

Nach Ablauf holen Sie nur dann ein neues Angebot ein, wenn Sie noch kein Geld gesendet haben. Behalten Sie die ursprüngliche Bestellung für eine bereits gesendete Überweisung; Bestätigungen können später eintreffen. Eine exakte Zahlung, die innerhalb ihres Angebotsfensters eingeht, qualifiziert sich nach Verifizierung für das angegebene USD-Guthaben. Verspätete Überweisungen oder andere Beträge erfordern eine Überprüfung; eine ausstehende Zahlung schaltet den KI-Zugang nicht frei. Siehe Abrechnung.

Abrechnung und API-Schlüssel

Verstehen Sie Nutzungsgebühren, reserviertes Guthaben und Steuerungen für jeden Schlüssel.

Wie wird eine Modellanfrage bepreist?

Die Kosten verwenden getrennte Modellraten für tatsächliche Eingabe- und Ausgabetokens, die nach einer anfänglichen Kreditreservierung aus der vom Anbieter bestätigten Nutzung abgerechnet werden.

Gemeinsame Inferenz hat getrennte Eingabe- und Ausgaberaten für jedes Modell. Eine zugelassene Anfrage reserviert genug Guthaben für die gezählte Eingabe und die maximal angeforderte Ausgabe und rechnet dann gegen die maßgebliche Nutzung zu den mit dieser Reservierung gespeicherten Raten ab. Verwende die Preistabelle, um deine Arbeitslast zu schätzen. Modelle ohne veröffentlichte Preise können keine bezahlten Anfragen annehmen. Eine Anfrage, die vor dem Inferenzversand abgelehnt wird, verursacht keine Token-Gebühr. Siehe Abrechnung.

Warum kann mein verfügbares Guthaben niedriger sein als mein Saldo?

Verfügbares Guthaben ist der Ledger-Saldo abzüglich ausstehender Inferenzreservierungen, die gehalten werden, bis die autoritative Nutzung abgerechnet werden kann.

Der Saldo stammt aus dem Konto-Ledger; das verfügbare Guthaben zieht außerdem ausstehende Inferenzreservierungen ab. Eine Reservierung hält die maximal zulässigen Anfragekosten, damit gleichzeitige Anfragen nicht dasselbe Guthaben ausgeben können. Wenn die autoritative Nutzung eintrifft, ersetzt die endgültige Gebühr die Sperre. Wenn ein Stream abbricht oder die Anbieternutzung fehlt, kann diese Reservierung auf die Abstimmung warten bleiben. Ein getrennter Client beweist nicht, dass die Generierung gestoppt hat. Konsultieren Sie Streaming und Abrechnung und melden Sie eine ungeklärte Sperre über den Support.

Was schützen Ausgabenlimits und Modellbeschränkungen?

Ausgabenlimits decken die lebenslange Nutzung jedes Schlüssels und ausstehende Reservierungen ab, während Modell-Positivlisten seine erlaubten Modelle einschränken; Limits setzen sich nicht monatlich zurück.

Jeder Schlüssel hat ein lebenslanges USD-Ausgabenlimit, das verbuchte Nutzung und ausstehende Reservierungen umfasst. Es setzt sich nicht monatlich zurück. Eine Modell-Positivliste begrenzt die exakten Modell-IDs, die der Schlüssel verwenden darf; eine leere Liste erlaubt alle verfügbaren Katalogmodelle. Verwende getrennte Schlüssel, um Anwendungen und Umgebungen in Nutzungsdatensätzen zu unterscheiden. Schlüsselkontrollen fügen kein Kontoguthaben hinzu oder ändern die Modellverfügbarkeit. Siehe Authentifizierung.

Was sollte ich tun, wenn ich einen API-Schlüssel verliere oder offenlege?

Widerrufen Sie einen offengelegten Schlüssel umgehend, erstellen Sie einen Ersatz und aktualisieren Sie Ihre Anwendung; vorhandene Geheimnisse können nicht erneut angezeigt werden.

Die Konsole kann ein vorhandenes Geheimnis nicht erneut anzeigen. Erstellen Sie einen Ersatzschlüssel, speichern Sie ihn sicher, aktualisieren Sie die Anwendungen, die ihn verwenden, und widerrufen Sie den alten Schlüssel. Wenn der Schlüssel offengelegt wurde, widerrufen Sie ihn umgehend und prüfen Sie die Nutzungsdatensätze des Kontos. Der Widerruf verhindert, dass neue Anfragen mit diesem Schlüssel zugelassen werden; bereits zugelassene Arbeit kann dennoch abgerechnet werden. Fügen Sie niemals einen API-Schlüssel in eine Support-Nachricht, ein öffentliches Repository oder ein Browser-Bundle ein. Befolgen Sie den Authentifizierungsleitfaden.

Kann ich ungenutztes Guthaben abheben oder eine automatische Rückerstattung erhalten?

Wallet-Abhebungen sind derzeit nicht verfügbar. Bestätigtes Guthaben kann für Dienstnutzung bezahlt werden; die Stornierung einer GPU-Bestellung vor der Aktivierung gibt ihre Zahlung auf dein Kontoguthaben zurück.

Wallet-Abhebungen sind derzeit nicht verfügbar. Verwende bestätigtes Prepaid-Guthaben für berechtigte Modellanfragen oder dedizierte GPU-Bestellungen. Die Stornierung einer bezahlten GPU-Bestellung vor der Aktivierung gibt diese Mietzahlung auf dein WeightsAPI-Kontoguthaben zurück; sie sendet keine Kryptowährung an ein Wallet. Keine automatische Rückerstattung oder Wallet-Auszahlung wird versprochen. Prüfe Abrechnung, bevor du Guthaben hinzufügst.

Daten und Datenschutz

Trennen Sie die Prompt-Verarbeitung von den für den Kontobetrieb erforderlichen Aufzeichnungen.

Speichert WeightsAPI meine Prompts oder Modellantworten?

Das Gateway speichert Prompts oder Antworten nicht in seiner Anwendungsdatenbank. Kontodatensätze bleiben bestehen, und die Anbieteraufbewahrung erfordert eine separate Überprüfung.

Das Gateway speichert Prompts, Vervollständigungstext oder Tool-Argumente nicht in seiner Anwendungsdatenbank, und Anwendungsprotokolle lassen Anfragekörper aus. Authentifizierungs-, Nutzungs- und Zahlungsdatensätze werden getrennt gespeichert. Anbieteraufbewahrung und Infrastrukturprotokollierung erfordern eine unabhängige Überprüfung; das Gateway-Verhalten ist keine End-to-End-Garantie für Null-Aufbewahrung. Lies Datenverarbeitung und die Vertrauensseite für den Umfang.

Welche Aufzeichnungen werden geführt, wenn Prompt-Inhalte nicht protokolliert werden?

Kontoidentifikatoren, Schlüssel-Hashes, Zahlungsdatensätze, Tokenzahlen, Gebühren und Reservierungsmetadaten werden für Authentifizierung und Abrechnung aufbewahrt, ohne Konversationstext zu speichern.

Das Kontosystem führt Identifikatoren, API-Schlüssel-Hashes und Metadaten, Einzahlungs- und Auszahlungsdatensätze, Tokenzahlen, Gebühren und Nutzungsaggregate. Anfrage-Reservierungen erfassen außerdem das Modell, die anwendbaren Raten und den Abrechnungsstatus, damit die Abrechnung abgeglichen werden kann. Diese Datensätze unterstützen Authentifizierung, Ausgabensteuerung und Abrechnung, ohne Konversationstext zu speichern. „Keine Inhaltsprotokollierung“ bedeutet daher nicht anonyme Nutzung oder keine aufbewahrten Datensätze. Konsultieren Sie Datenverarbeitung; Aufbewahrungsfristen und Produktions-Datenrechteverfahren benötigen noch veröffentlichte, verifizierte Bedingungen.

Dedizierte GPU-Bestellungen speichern die ausgewählte Hardware und das Modell, den Monatspreis, Zahlungs- und Stornierungsstatus sowie Servicedaten und Endpunktdetails, wenn die Bereitstellung bestätigt ist.

Deckt die Datenschutzerklärung auch den Inferenzanbieter ab?

Nein: Die Inhaltsrichtlinie des Gateways begründet keine Aufbewahrungs- oder Trainingspraktiken eines Inferenzanbieters, die weiterhin überprüft werden müssen.

Das Verhalten des Gateways begründet keine Aufbewahrungs- oder Trainingsrichtlinie eines anderen Anbieters. Die Bearbeitung einer Anfrage erfordert die Weitergabe ihres Inhalts an den Inferenzanbieter. Anbieterprotokollierung, Unterauftragsverarbeiter und vertragliche Bedingungen erfordern eine separate Überprüfung. Wenn deine Arbeitslast Vertraulichkeits- oder regulatorische Anforderungen hat, überprüfe die Vertrauensseite und bestätige die relevanten Vereinbarungen, bevor du sensible Inhalte sendest.

Wo werden Anfragen verarbeitet, und kann ich eine Region wählen?

Dallas, Ashburn und Portland sind geplante Standorte, ohne verifizierte Flottenverfügbarkeit, kundengewählte Region oder Produktionsverpflichtung zur Datenresidenz.

Dallas, Ashburn und Portland sind Ziel-GPU-Standorte. Verfügbarkeit, Routing und Datenresidenz erfordern eine Bestätigung für das tatsächliche Deployment; Standortnamen allein begründen diese Bedingungen nicht. Regionswahl und End-to-End-Residenzverpflichtungen müssen für das Deployment vereinbart werden. Überprüfe Datenverarbeitung und die Vertrauensseite, bevor du eine Arbeitslast mit regionalen Anforderungen festlegst.

Ist eine bestätigte Einzahlung vor der KI-Nutzung erforderlich?

Jede KI-Interaktion erfordert eine qualifizierende bestätigte Einzahlung; das Minimum beträgt 100 USD pro Aufladung, kein dauerhaftes Mindestguthaben.

Ja. Vor der ersten KI-Nutzung muss deinem Konto einmal eine bestätigte Aufladung von mindestens 100 USD gutgeschrieben werden; es gibt kein öffentliches kostenloses Testkontingent. Jede spätere Aufladung beginnt ebenfalls bei 100 USD. Nach der anfänglichen qualifizierenden Einzahlung kann verbleibendes Guthaben unter 100 USD weiterhin Anfragen bezahlen, bis es unzureichend ist. Verwende einen aktiven Schlüssel mit den erforderlichen Modellberechtigungen und Budget. Der Checkout liefert Zahlungsanweisungen und ein zeitlich begrenztes Krypto-Angebot. Guthaben erfordert eine abgeglichene, verifizierte Transaktion; das Erstellen oder Aktualisieren eines Auftrags bestätigt die Zahlung nicht.

Leistung und Support

Planen Sie die Kapazität sorgfältig und sammeln Sie nützliche Details, wenn etwas fehlschlägt.

Welche Latenz oder welchen Durchsatz kann ich erwarten?

Die Leistung hängt vom Modell, der Hardware, der Arbeitslast, der Serving-Konfiguration und der Parallelität ab. Validiere sie mit deiner eigenen Arbeitslast; keine Latenz- oder Durchsatzgarantie wird angeboten.

Die Leistung hängt vom Modell, der Hardware, der Prompt-Länge, der generierten Länge, der Parallelität und der Serving-Konfiguration ab. Miss auf einem verfügbaren Deployment die Zeit bis zum ersten Token und die Generierungsgeschwindigkeit separat mit einer repräsentativen Arbeitslast. Veröffentlichte Modellmerkmale und Hardwarespezifikationen sind keine SLA. Überprüfe dedizierte Kapazität für Arbeitslasten, die reservierte Ressourcen benötigen, und den Dienststatus für Verfügbarkeit.

Sind Anfragen unbegrenzt, wenn ich genügend Guthaben habe?

Guthaben macht die Nutzung nicht unbegrenzt: Kapazität, Kontext, Ausgabelimits, Modellberechtigungen und Schlüssel-Ausgabenlimits schränken Anfragen weiterhin ein.

Nein. Das aktuelle Design erlegt bezahltem Traffic kein standardmäßiges festes Produktlimit für Anfragen pro Minute auf, aber die Zulassung hängt weiterhin von verfügbarem Guthaben, Schlüssel-Limits, erlaubten Modellen, Ausgabelimits, Kontextgröße und Backend-Kapazität ab. Gemeinsames Serving kann Warteschlangen verursachen, und der Playground folgt denselben Regeln für bestätigte Aufladung, verfügbares Guthaben und Schlüsselbudget wie API-Anfragen. Das native Kontextfenster eines Modells kann außerdem die konfigurierte Dienstobergrenze überschreiten. Prüfen Sie Limits und behandeln Sie Fehler mit begrenzten Wiederholungsversuchen; behandeln Sie Guthaben nicht als Kapazitätsgarantie.

Kann ich jetzt einen dedizierten GPU-Endpunkt bestellen?

Ja. Wähle eine GPU, wähle ein Modell und gib eine monatliche Bestellung auf. Die Zahlung erfolgt aus bestätigtem Kontoguthaben; die Hardware wird nach bestätigter Bereitstellung verfügbar.

Verwende die Dedizierte-GPU-Seite, um eine Konfiguration zu wählen und den Checkout zu öffnen. Wenn dein Guthaben nicht ausreicht, lade es in Krypto auf und kehre zurück, sobald das Guthaben bestätigt ist, um die Bestellung zu bezahlen. Eine Einzahlung zahlt die Miete nicht automatisch. Der vorausbezahlte Monat beginnt bei Aktivierung, ohne automatische Verlängerung. Vor der Aktivierung gibt die Stornierung jede Mietzahlung auf dein Kontoguthaben zurück. Hardwareverfügbarkeit und Lieferzeit erfordern eine Betreiberbestätigung; eine Bestellung ist keine aktive Maschine.

Wie sollte ich die Statusseite und einen 503-Fehler interpretieren?

Ein 503 bedeutet, dass der erforderliche Dienst nicht verfügbar ist. Prüfe den Dienststatus und die Fehlermeldung, bevor du es erneut versuchst; eine Verbindungseinstellung begründet keine Betriebszeit.

Ein 503 service_unavailable bedeutet, dass das erforderliche Deployment oder der Zusatzdienst die Anfrage nicht annehmen kann. Prüfe die Statusseite und den Fehlerleitfaden, bevor du begrenzte Wiederholungsversuche verwendest. Eine Verbindungseinstellung allein ist kein Beweis für einen gesunden Dienst oder gemessene Betriebszeit. Anfragen, die vor dem Inferenzversand abgelehnt werden, verursachen keine Token-Gebühr.

Welche Informationen sollte ich angeben, wenn ich um Hilfe bitte?

Gib den Vorgang, die Zeit und Zeitzone, das Modell, den Fehlercode und relevante Referenzen an; entferne API-Schlüssel, Wallet-Geheimnisse und unnötigen Prompt-Inhalt.

Verwende die Support-Seite, um den betroffenen Vorgang, die ungefähre Zeit und Zeitzone, die Modell-ID, den Fehlercode und das erwartete Ergebnis vorzubereiten. Für Abrechnung oder Einzahlungen füge die Anfrage- oder Auftragsreferenz und die öffentliche Transaktionskennung hinzu, falls zutreffend. Entferne API-Schlüssel, Wallet-Geheimnisse und unnötigen Prompt-Inhalt. Das Kopieren eines Berichts übermittelt ihn nicht. Offizielle Support-Kontakte, Servicezeiten und Reaktionsziele werden nicht veröffentlicht.

Brauchen Sie einen nächsten Schritt?

Finden Sie den passenden Leitfaden oder bereiten Sie die Details Ihres Problems vor.

Support öffnen