weightsapi.INFERÊNCIAConsole
Navegação
Continue.dev

Continue.dev

Configure o Continue.dev com o endpoint compatível com OpenAI da WeightsAPI.

Antes de conectar#

O acesso à IA requer login, uma recarga confirmada de pelo menos USD 100, uma chave de API autorizada e crédito disponível suficiente para a solicitação. Cada recarga posterior também tem um mínimo de USD 100; saldos restantes menores permanecem utilizáveis quando cobrem a solicitação. O crédito requer verificação da transação. Verifique o status do serviço para disponibilidade do modelo antes de enviar tráfego. Use sua própria chave de API sem o prefixo Bearer nos campos de chave. A URL base já inclui /v1. Essas configurações foram verificadas em relação à documentação oficial, não testadas em uma implantação GPU ao vivo.

Configuração#

Mescle o modelo no config.yaml do Continue e insira seu endpoint, chave de API e ID exato do modelo antes de salvar:

name: Managed inference
version: 1.0.0
schema: v1
models:
  - name: Qwen3 32B
    provider: openai
    model: Qwen/Qwen3-32B
    apiBase: https://weightsapi.com/v1
    apiKey: WEIGHTSAPI_API_KEY
    roles:
      - chat
      - edit
    useResponsesApi: false

O campo exato é apiBase, não baseURL. provider: openai está documentado para provedores compatíveis. Mantenha Chat/Edit comum como a receita básica; o modo agente depende adicionalmente do suporte nativo a ferramentas. O caminho Qwen padrão já usa Chat Completions; useResponsesApi: false explícito torna a superfície de API pretendida clara.

Fontes: Configuração de provedor compatível com OpenAI, Referência config.yaml.

Verifique a conexão#

Busque a lista de modelos e, em seguida, envie uma mensagem curta. Uma lista de modelos bem-sucedida não comprova suporte a ferramentas, visão ou esquema JSON. Verifique os recursos da implantação selecionada antes de habilitá-los.