weightsapi.INFERENZKonsole
Navigation
Continue.dev

Continue.dev

Konfigurieren Sie Continue.dev mit dem WeightsAPI OpenAI-kompatiblen Endpunkt.

Bevor Sie sich verbinden#

Der KI-Zugriff erfordert eine Anmeldung, eine bestätigte Aufladung von mindestens USD 100, einen autorisierten API-Schlüssel und ausreichend verfügbares Guthaben für die Anfrage. Jede spätere Aufladung hat ebenfalls ein Minimum von USD 100; kleinere Restguthaben bleiben nutzbar, wenn sie die Anfrage abdecken. Das Guthaben erfordert eine Transaktionsverifizierung. Prüfen Sie den Servicestatus auf Modellverfügbarkeit, bevor Sie Traffic senden. Verwenden Sie Ihren eigenen API-Schlüssel ohne das Bearer-Präfix in Schlüsselfeldern. Die Basis-URL enthält bereits /v1. Diese Konfigurationen wurden anhand der offiziellen Dokumentation geprüft, nicht gegen ein Live-GPU-Deployment getestet.

Konfiguration#

Fügen Sie das Modell in Continues config.yaml ein und geben Sie Ihren Endpunkt, API-Schlüssel und die exakte Modell-ID ein, bevor Sie speichern:

name: Managed inference
version: 1.0.0
schema: v1
models:
  - name: Qwen3 32B
    provider: openai
    model: Qwen/Qwen3-32B
    apiBase: https://weightsapi.com/v1
    apiKey: WEIGHTSAPI_API_KEY
    roles:
      - chat
      - edit
    useResponsesApi: false

Das exakte Feld ist apiBase, nicht baseURL. provider: openai ist für kompatible Anbieter dokumentiert. Halten Sie normales Chat/Edit als Grundrezept; der Agentenmodus hängt zusätzlich von nativer Tool-Unterstützung ab. Der Standard-Qwen-Pfad verwendet bereits Chat Completions; explizites useResponsesApi: false macht die beabsichtigte API-Oberfläche klar.

Quellen: OpenAI-kompatible Anbieterkonfiguration, config.yaml-Referenz.

Verbindung überprüfen#

Rufen Sie die Modellliste ab und senden Sie dann eine kurze Nachricht. Eine erfolgreiche Modellliste beweist keine Unterstützung für Tools, Vision oder JSON-Schema. Überprüfen Sie die Funktionen der ausgewählten Bereitstellung, bevor Sie sie aktivieren.