Bevor Sie sich verbinden#
Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Aufladung von mindestens USD 100, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Aufladung hat ebenfalls ein Minimum von USD 100; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Das Guthaben erfordert eine Transaktionsverifizierung. Prüfen Sie den Servicestatus auf Modellverfügbarkeit, bevor Sie Traffic senden. Verwenden Sie Ihren eigenen API-Schlüssel ohne das Bearer-Präfix in Schlüsselfeldern. Die Basis-URL enthält bereits /v1. Diese Konfigurationen wurden anhand der offiziellen Dokumentation geprüft, nicht gegen ein Live-GPU-Deployment getestet.
Konfiguration#
Konfigurieren Sie den benutzerdefinierten Endpunkt in librechat.yaml; stellen Sie dem LibreChat-Server seine Umgebungsvariablen bereit, binden Sie diese Konfiguration bei Bedarf ein und starten Sie LibreChat neu.
endpoints:
custom:
- name: "Managed inference"
apiKey: "${WEIGHTSAPI_API_KEY}"
baseURL: "${https://weightsapi.com/v1}"
models:
default: ["Qwen/Qwen3-32B"]
fetch: false
titleConvo: false
modelDisplayLabel: "Qwen3 32B"
apiKey, baseURL und models.default sind dokumentierte Felder für benutzerdefinierte Endpunkte. fetch: false verwendet die explizite Modellliste. Das Weglassen von provider verwendet den OpenAI-kompatiblen Client. titleConvo: false vermeidet einen zusätzlichen Aufruf zur Titelgenerierung. Fügen Sie dies in die bestehende Datei ein und bewahren Sie die oberste Konfigurationsversion der installierten Version.
Quellen: Struktur benutzerdefinierter Endpunkte, Konfigurationsinstallation.
Verbindung überprüfen#
Rufen Sie die Modellliste ab und senden Sie dann eine kurze Nachricht. Eine erfolgreiche Modellliste beweist keine Unterstützung für Tools, Vision oder JSON-Schema. Überprüfen Sie die Funktionen der ausgewählten Bereitstellung, bevor Sie sie aktivieren.