Bez KYC
W bieżącym procesie logowania nie ma przesyłania dokumentu tożsamości ani kroku KYC. Dostęp i korzystanie pozostają powiązane z Twoim kontem.
Wybieraj opublikowane modele o otwartych wagach przez API zgodne z OpenAI. Zachowaj znane narzędzia, porównuj koszty tokenów i dopasuj model do swojego obciążenia.
W bieżącym procesie logowania nie ma przesyłania dokumentu tożsamości ani kroku KYC. Dostęp i korzystanie pozostają powiązane z Twoim kontem.
WeightsAPI nie dodaje żadnego filtra treści na bramie. Własne wyszkolenie modelu może nadal prowadzić do odmowy żądania.
Wybierz model z katalogu, napisz krótki prompt i sprawdź dopasowany kod. Zachowaj prostotę pierwszego przykładu, aby żądanie i oczekiwana odpowiedź były łatwe do sprawdzenia.
Dostęp do konta Zaloguj się i potwierdź doładowanie w wysokości co najmniej 100 USD, a następnie wydawaj przedpłacone środki. Każde doładowanie ma to samo minimum; mniejsze pozostałe salda pozostają użyteczne. Sprawdź status usługi, aby poznać dostępność modeli.
Sprawdź dostęp przed pierwszym żądaniem
Zaloguj się, potwierdź doładowanie co najmniej 100 USD i wybierz klucz API, aby wysłać pierwsze żądanie.curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true,
"max_tokens": 512
}'* Kontekst usługi. Zobacz stronę modelu, aby poznać natywne okno i wymagania konfiguracyjne.
Książka kucharska daje małe przykłady do adaptacji, przy czym aplikacja nadal ma kontrolę.
Zbuduj pętlę konwersacji, zarządzaj historią wiadomości i weryfikuj odpowiedzi, które otrzymują użytkownicy. Zacznij od przykładu terminalowego, zanim dodasz interfejs użytkownika.
Poznaj pętlę wywoływania narzędzi z jawną listą dozwolonych i kontrolą argumentów. Wsparcie modelu i wdrożenia musi zostać zweryfikowane przed włączeniem akcji.
Użyj własnego retrievera, dostarcz wybrane fragmenty i weryfikuj cytaty. Przykład wykorzystuje proste dopasowywanie tekstu; usługa osadzania nie jest dostępna.
Zdecyduj, czego potrzebuje Twoja aplikacja, zanim zwiększysz ruch lub dodasz więcej funkcji.
Porównaj możliwości, licencje modeli, kontekst i stawki wejścia/wyjścia. Sprawdź status usługi i potwierdzone limity wdrożenia przed kierowaniem żądań do modelu.
Użyj formatu chat-completions z dokładnym identyfikatorem modelu i ograniczonym wynikiem. Przeczytaj przewodniki o strumieniowaniu i błędach przed dodaniem ponowień lub narzędzi.
Oddzielaj aplikacje za pomocą odrębnych kluczy i limitów wydatków. Konsola to miejsce, w którym sprawdzisz wykorzystanie i dostępne środki, w tym kwoty zarezerwowane na oczekujące żądania.
Porównaj opublikowane opcje poniżej, a następnie otwórz stronę modelu, aby poznać jego możliwości, licencję i uwagi dotyczące wdrożenia. Sama cena nie świadczy o jakości ani szybkości.
| Model | Wejście | Wyjście | Kontekst usługi |
|---|---|---|---|
| LLlama 3.1 8B | 0,03 USD | 0,05 USD | 131 072 |
| QQwen3 32B | 0,15 USD | 0,20 USD | 131 072 |
| DDeepSeek V3 | 0,25 USD | 0,85 USD | 131 072 |
| DDeepSeek R1 | 0,50 USD | 2,15 USD | 131 072 |
Stawki wejścia i wyjścia podane są w USD za milion tokenów. Limity kontekstu usługi wymagają potwierdzenia wdrożenia; limity natywne modelu są odrębne.
Połącz znane narzędzia, korzystając z ich udokumentowanych ustawień. Zweryfikuj funkcje, których potrzebuje Twoja aplikacja, na wybranym wdrożeniu przed przeniesieniem ruchu.
Skonfiguruj niestandardowe połączenie czatu zgodne z OpenAI i sprawdź wybór modelu przed wysłaniem wiadomości testowej.
Skonfiguruj połączenie API OpenAI dla interfejsu czatu, z wykrywaniem modeli lub jawnym filtrem modeli.
Przygotuj dostawcę OpenAI Compatible i dopasuj kontekst, limity wyjściowe oraz ustawienia możliwości do rzeczywistego wdrożenia.
Zacznij od modelu czatu OpenAI w podstawowym łańcuchu. Przepływy pracy agentów wymagają osobno zweryfikowanego wsparcia wywoływania narzędzi.
Przejrzyj kontrolki konta, obsługę danych i wymagania wdrożeniowe przed wyborem modelu.
Brama nie przechowuje promptów ani odpowiedzi. Przechowywanie u dostawcy i logowanie w infrastrukturze nadal wymagają weryfikacji; nie jest to gwarancja braku przechowywania od końca do końca.
Porównuj wejście i wyjście osobno i szacuj na podstawie własnego obciążenia. Dedykowana pojemność podlega innemu modelowi rezerwacji.
Skorzystaj z przewodnika wsparcia, aby zdiagnozować błędy i przygotować raport. Sprawdź status usługi, aby uzyskać informacje o dostępności i monitorowaniu.
Zrozum dostępność, kompatybilność, koszty i przetwarzanie danych, zanim wbudujesz je w swoją aplikację.
Bieżący proces logowania nie obejmuje przesyłania dokumentu tożsamości ani weryfikacji KYC. Wymagane jest zalogowane konto, a korzystanie pozostaje powiązane z tym kontem.
WeightsAPI nie dodaje filtra treści na poziomie bramy. Katalog obejmuje oryginalne modele i warianty dostrojone opublikowane przez ich twórców, w tym Dolphin i Hermes. Niektóre warianty są zaprojektowane w celu ograniczenia odmów; trening modelu może nadal powodować odmowy. Przeczytaj notatki dotyczące źródła i zachowania każdego modelu.
Zarządzaj kluczami API, twórz zamówienia na doładowania kryptowalutami i składaj zamówienia na dedykowane GPU. Sprawdzaj status usługi pod kątem dostępności modeli; akceptacja płatności i aktywacja GPU wymagają potwierdzenia.
API korzysta z formatów Chat Completions, starszego Completions i tras wykrywania modeli. Sprawdź możliwości wybranego wdrożenia; API specyficzne dla dostawcy nie są wymienne.
Koszty wykorzystują oddzielne stawki modelu za rzeczywiste tokeny wejściowe i wyjściowe, rozliczane na podstawie użycia potwierdzonego przez dostawcę po wstępnej rezerwacji kredytu.
Brama nie utrwala promptów ani odpowiedzi w swojej bazie danych aplikacji. Rekordy konta pozostają, a retencja dostawcy wymaga osobnej weryfikacji.
Zacznij od katalogu i małego przykładu. Dokumentacja wyjaśnia format żądania; FAQ pomaga rozstrzygnąć związane z tym decyzje.