weightsapi.INFÉRENCEConsole
Navigation
Continue.dev

Continue.dev

Configurez Continue.dev avec le point de terminaison compatible OpenAI de WeightsAPI.

Avant de vous connecter#

L'accès à l'IA nécessite une connexion, un premier rechargement confirmé d'au moins 100 USD, une clé API autorisée et suffisamment de crédit disponible pour la requête. Chaque rechargement ultérieur a également un minimum de 100 USD ; les soldes restants plus petits restent utilisables lorsqu'ils couvrent la requête. Le crédit nécessite une vérification de transaction. Consultez le statut du service pour la disponibilité des modèles avant d'envoyer du trafic. Utilisez votre propre clé API sans le préfixe Bearer dans les champs de clé. L'URL de base comprend déjà /v1. Ces configurations ont été vérifiées par rapport à la documentation officielle, pas testées contre un déploiement GPU en direct.

Configuration#

Fusionnez le modèle dans le config.yaml de Continue et saisissez votre point de terminaison, votre clé API et l'identifiant de modèle exact avant d'enregistrer :

name: Managed inference
version: 1.0.0
schema: v1
models:
  - name: Qwen3 32B
    provider: openai
    model: Qwen/Qwen3-32B
    apiBase: https://weightsapi.com/v1
    apiKey: WEIGHTSAPI_API_KEY
    roles:
      - chat
      - edit
    useResponsesApi: false

Le champ exact est apiBase, pas baseURL. provider: openai est documenté pour les fournisseurs compatibles. Gardez Chat/Edit ordinaire comme recette de base ; le mode agent dépend en outre du support natif des outils. Le chemin Qwen par défaut utilise déjà Chat Completions ; un useResponsesApi: false explicite clarifie la surface API prévue.

Sources : Configuration du fournisseur compatible OpenAI, référence config.yaml.

Vérifier la connexion#

Récupérez la liste des modèles, puis envoyez un message court. Une récupération réussie de la liste des modèles ne prouve pas la prise en charge des outils, de la vision ou du schéma JSON. Vérifiez les capacités du déploiement sélectionné avant de les activer.