weightsapi.INFERENZKonsole
Navigation
SillyTavern

SillyTavern

Konfigurieren Sie SillyTavern mit dem WeightsAPI OpenAI-kompatiblen Endpunkt.

Bevor Sie sich verbinden#

Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Aufladung von mindestens USD 100, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Aufladung hat ebenfalls ein Minimum von USD 100; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Das Guthaben erfordert eine Transaktionsverifizierung. Prüfen Sie den Servicestatus auf Modellverfügbarkeit, bevor Sie Traffic senden. Verwenden Sie Ihren eigenen API-Schlüssel ohne das Bearer-Präfix in Schlüsselfeldern. Die Basis-URL enthält bereits /v1. Diese Konfigurationen wurden anhand der offiziellen Dokumentation geprüft, nicht gegen ein Live-GPU-Deployment getestet.

Konfiguration#

Wählen Sie in den API-Verbindungen Chat Completion als API-Typ und Custom (OpenAI-kompatibel) als Chat Completion Source. Geben Sie https://weightsapi.com/v1 in das Feld für die benutzerdefinierte Endpunkt-URL und den Dienstschlüssel in das Feld für den benutzerdefinierten API-Schlüssel ein. Wählen Sie Qwen/Qwen3-32B aus der Modellliste oder geben Sie diese genaue Modell-ID manuell ein. Verwenden Sie Testnachricht, um eine Vervollständigung zu überprüfen. Die Dokumentation sagt ausdrücklich, dass /chat/completions nicht angehängt werden soll. Die Modell-Autoerkennung erfordert /v1/models.

Quelle: SillyTavern Chat Completions – benutzerdefinierter Endpunkt.

Verbindung überprüfen#

Rufen Sie die Modellliste ab und senden Sie dann eine kurze Nachricht. Eine erfolgreiche Modellliste beweist keine Tools-, Vision- oder JSON-Schema-Unterstützung. Überprüfen Sie die Fähigkeiten der ausgewählten Bereitstellung, bevor Sie sie aktivieren.