Bevor Sie sich verbinden#
Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Aufladung von mindestens USD 100, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Aufladung hat ebenfalls ein Minimum von USD 100; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Das Guthaben erfordert eine Transaktionsverifizierung. Prüfen Sie den Servicestatus auf Modellverfügbarkeit, bevor Sie Traffic senden. Verwenden Sie Ihren eigenen API-Schlüssel ohne das Bearer-Präfix in Schlüsselfeldern. Die Basis-URL enthält bereits /v1. Diese Konfigurationen wurden anhand der offiziellen Dokumentation geprüft, nicht gegen ein Live-GPU-Deployment getestet.
Konfiguration#
Fügen Sie das Modell in Continues config.yaml ein und geben Sie Ihren Endpunkt, API-Schlüssel und die exakte Modell-ID ein, bevor Sie speichern:
name: Managed inference
version: 1.0.0
schema: v1
models:
- name: Qwen3 32B
provider: openai
model: Qwen/Qwen3-32B
apiBase: https://weightsapi.com/v1
apiKey: WEIGHTSAPI_API_KEY
roles:
- chat
- edit
useResponsesApi: false
Das exakte Feld ist apiBase, nicht baseURL. provider: openai ist für kompatible Anbieter dokumentiert. Halten Sie normales Chat/Edit als Grundrezept; der Agentenmodus hängt zusätzlich von nativer Tool-Unterstützung ab. Der Standard-Qwen-Pfad verwendet bereits Chat Completions; explizites useResponsesApi: false macht die beabsichtigte API-Oberfläche klar.
Quellen: OpenAI-kompatible Anbieterkonfiguration, config.yaml-Referenz.
Verbindung überprüfen#
Rufen Sie die Modellliste ab und senden Sie dann eine kurze Nachricht. Eine erfolgreiche Modellliste beweist keine Unterstützung für Tools, Vision oder JSON-Schema. Überprüfen Sie die Funktionen der ausgewählten Bereitstellung, bevor Sie sie aktivieren.