Bevor Sie sich verbinden#
Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Aufladung von mindestens USD 100, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Aufladung hat ebenfalls ein Minimum von USD 100; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Das Guthaben erfordert eine Transaktionsverifizierung. Prüfen Sie den Servicestatus auf Modellverfügbarkeit, bevor Sie Traffic senden. Verwenden Sie Ihren eigenen API-Schlüssel ohne das Bearer-Präfix in Schlüsselfeldern. Die Basis-URL enthält bereits /v1. Diese Konfigurationen wurden anhand der offiziellen Dokumentation geprüft, nicht gegen ein Live-GPU-Deployment getestet.
Konfiguration#
Wählen Sie in den API-Verbindungen Chat Completion als API-Typ und Custom (OpenAI-kompatibel) als Chat Completion Source. Geben Sie https://weightsapi.com/v1 in das Feld für die benutzerdefinierte Endpunkt-URL und den Dienstschlüssel in das Feld für den benutzerdefinierten API-Schlüssel ein. Wählen Sie Qwen/Qwen3-32B aus der Modellliste oder geben Sie diese genaue Modell-ID manuell ein. Verwenden Sie Testnachricht, um eine Vervollständigung zu überprüfen. Die Dokumentation sagt ausdrücklich, dass /chat/completions nicht angehängt werden soll. Die Modell-Autoerkennung erfordert /v1/models.
Quelle: SillyTavern Chat Completions – benutzerdefinierter Endpunkt.
Verbindung überprüfen#
Rufen Sie die Modellliste ab und senden Sie dann eine kurze Nachricht. Eine erfolgreiche Modellliste beweist keine Tools-, Vision- oder JSON-Schema-Unterstützung. Überprüfen Sie die Fähigkeiten der ausgewählten Bereitstellung, bevor Sie sie aktivieren.