Zanim się połączysz#
Dostęp do AI wymaga zalogowania, jednego potwierdzonego doładowania w wysokości co najmniej 100 USD, autoryzowanego klucza API i wystarczających dostępnych środków na żądanie. Każde kolejne doładowanie również ma minimum 100 USD; mniejsze pozostałe salda pozostają użyteczne, gdy pokrywają żądanie. Środki wymagają weryfikacji transakcji. Sprawdź status usługi, aby poznać dostępność modeli przed wysłaniem ruchu. Użyj własnego klucza API bez prefiksu Bearer w polach klucza. Bazowy adres URL już zawiera /v1. Te konfiguracje zostały sprawdzone pod kątem oficjalnej dokumentacji, a nie przetestowane na działającym wdrożeniu GPU.
Konfiguracja#
Scal model w config.yaml aplikacji Continue i wprowadź swój endpoint, klucz API oraz dokładny identyfikator modelu przed zapisaniem:
name: Managed inference
version: 1.0.0
schema: v1
models:
- name: Qwen3 32B
provider: openai
model: Qwen/Qwen3-32B
apiBase: https://weightsapi.com/v1
apiKey: WEIGHTSAPI_API_KEY
roles:
- chat
- edit
useResponsesApi: false
Dokładne pole to apiBase, a nie baseURL. provider: openai jest udokumentowane dla kompatybilnych dostawców. Zachowaj zwykły Chat/Edit jako podstawowy przepis; tryb agenta dodatkowo zależy od natywnego wsparcia narzędzi. Domyślna ścieżka Qwen już korzysta z Chat Completions; jawne useResponsesApi: false czyni zamierzoną powierzchnię API jasną.
Źródła: konfiguracja dostawcy zgodnego z OpenAI, odniesienie config.yaml.
Zweryfikuj połączenie#
Pobierz listę modeli, a następnie wyślij jedną krótką wiadomość. Pomyślne pobranie listy modeli nie dowodzi wsparcia dla narzędzi, wizji ani schematu JSON. Sprawdź możliwości wybranego wdrożenia przed ich włączeniem.