Antes de conectar#
O acesso à IA requer login, uma recarga confirmada de pelo menos USD 100, uma chave de API autorizada e crédito disponível suficiente para a solicitação. Cada recarga posterior também tem um mínimo de USD 100; saldos restantes menores permanecem utilizáveis quando cobrem a solicitação. O crédito requer verificação da transação. Verifique o status do serviço para disponibilidade do modelo antes de enviar tráfego. Use sua própria chave de API sem o prefixo Bearer nos campos de chave. A URL base já inclui /v1. Essas configurações foram verificadas em relação à documentação oficial, não testadas em uma implantação GPU ao vivo.
Configuração#
Mescle o modelo no config.yaml do Continue e insira seu endpoint, chave de API e ID exato do modelo antes de salvar:
name: Managed inference
version: 1.0.0
schema: v1
models:
- name: Qwen3 32B
provider: openai
model: Qwen/Qwen3-32B
apiBase: https://weightsapi.com/v1
apiKey: WEIGHTSAPI_API_KEY
roles:
- chat
- edit
useResponsesApi: false
O campo exato é apiBase, não baseURL. provider: openai está documentado para provedores compatíveis. Mantenha Chat/Edit comum como a receita básica; o modo agente depende adicionalmente do suporte nativo a ferramentas. O caminho Qwen padrão já usa Chat Completions; useResponsesApi: false explícito torna a superfície de API pretendida clara.
Fontes: Configuração de provedor compatível com OpenAI, Referência config.yaml.
Verifique a conexão#
Busque a lista de modelos e, em seguida, envie uma mensagem curta. Uma lista de modelos bem-sucedida não comprova suporte a ferramentas, visão ou esquema JSON. Verifique os recursos da implantação selecionada antes de habilitá-los.