weightsapi.INFERENCJAKonsola
Nawigacja
Dify

Dify

Skonfiguruj Dify z punktem końcowym WeightsAPI zgodnym z OpenAI.

Zanim się połączysz#

Dostęp do AI wymaga zalogowania, jednego potwierdzonego doładowania w wysokości co najmniej 100 USD, autoryzowanego klucza API i wystarczających dostępnych środków na żądanie. Każde kolejne doładowanie również ma minimum 100 USD; mniejsze pozostałe salda pozostają użyteczne, gdy pokrywają żądanie. Środki wymagają weryfikacji transakcji. Sprawdź status usługi, aby poznać dostępność modeli przed wysłaniem ruchu. Użyj własnego klucza API bez prefiksu Bearer w polach klucza. Bazowy adres URL już zawiera /v1. Te konfiguracje zostały sprawdzone pod kątem oficjalnej dokumentacji, a nie przetestowane na działającym wdrożeniu GPU.

Konfiguracja#

Zainstaluj oficjalnego dostawcę OpenAI-API-compatible (langgenius/openai_api_compatible), jeśli go nie ma, a następnie dodaj model w ustawieniach dostawcy modelu w obszarze roboczym. Pola dla modelu LLM/czat:

Pole Wartość
Typ LLM
Nazwa modelu Qwen/Qwen3-32B
Klucz API WEIGHTSAPI_API_KEY
Bazowy URL API https://weightsapi.com/v1
Tryb uzupełniania Chat
Typ API Chat Completions API (/chat/completions)
Rozmiar kontekstu modelu Rzeczywisty limit kontekstu wdrożenia
Górna granica maksymalnej liczby tokenów Rzeczywisty limit wyjściowy wdrożenia
Obsługa wizji Brak obsługi dla tego modelu wyłącznie tekstowego
Typ wywołania funkcji Brak obsługi do czasu zweryfikowania natywnych narzędzi

Dokładne nazwy podstawowych poświadczeń to api_key, endpoint_url, mode: chat, api_type: chat_completions, context_size i max_tokens_to_sample. Opcjonalna model name for API endpoint (endpoint_model_name) może nadpisać wysyłaną nazwę modelu; pozostaw puste, gdy Nazwa modelu już pasuje. Użyj bazowego adresu URL zawierającego /v1 dla tego przepisu LLM; ta wtyczka inaczej obsługuje ścieżki dla typów innych niż LLM, więc nie rozszerzaj tego przepisu na embeddingi bez sprawdzenia.

Źródła: Oficjalna lista marketplace, oficjalny schemat pól dostawcy.

Zweryfikuj połączenie#

Pobierz listę modeli, a następnie wyślij jedną krótką wiadomość. Pomyślne pobranie listy modeli nie dowodzi wsparcia dla narzędzi, wizji ani schematu JSON. Sprawdź możliwości wybranego wdrożenia przed ich włączeniem.