weightsapi.INFERENCJAKonsola
Nawigacja
Bez KYC · Bez dodatkowych filtrów treści

Zarządzane wnioskowanie LLM. Otwarte modele, jedno API.

Wybieraj opublikowane modele o otwartych wagach przez API zgodne z OpenAI. Zachowaj znane narzędzia, porównuj koszty tokenów i dopasuj model do swojego obciążenia.

Bez KYC

W bieżącym procesie logowania nie ma przesyłania dokumentu tożsamości ani kroku KYC. Dostęp i korzystanie pozostają powiązane z Twoim kontem.

Ukształtuj swoje pierwsze żądanie.

Wybierz model z katalogu, napisz krótki prompt i sprawdź dopasowany kod. Zachowaj prostotę pierwszego przykładu, aby żądanie i oczekiwana odpowiedź były łatwe do sprawdzenia.

Dostęp do konta Zaloguj się i potwierdź doładowanie w wysokości co najmniej 100 USD, a następnie wydawaj przedpłacone środki. Każde doładowanie ma to samo minimum; mniejsze pozostałe salda pozostają użyteczne. Sprawdź status usługi, aby poznać dostępność modeli.

Plac zabawWymagane zasilone konto
128K kontekst*
Sprawdzanie dostępu do konta…
Treść promptu nie jest zapisywana przez tę bramę.
OdpowiedźGotowe, gdy przejdą kontrole konta, klucza i usługi

Sprawdź dostęp przed pierwszym żądaniem

Zaloguj się, potwierdź doładowanie co najmniej 100 USD i wybierz klucz API, aby wysłać pierwsze żądanie.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
To samo żądanie w Twojej aplikacji.Przeczytaj szybki start

* Kontekst usługi. Zobacz stronę modelu, aby poznać natywne okno i wymagania konfiguracyjne.

Buduj wokół swojej aplikacji

Zacznij od przydatnego zadania.

Książka kucharska daje małe przykłady do adaptacji, przy czym aplikacja nadal ma kontrolę.

Asystenci konwersacyjni

Zbuduj pętlę konwersacji, zarządzaj historią wiadomości i weryfikuj odpowiedzi, które otrzymują użytkownicy. Zacznij od przykładu terminalowego, zanim dodasz interfejs użytkownika.

Przepis na chatbota

Kodowanie i narzędzia

Poznaj pętlę wywoływania narzędzi z jawną listą dozwolonych i kontrolą argumentów. Wsparcie modelu i wdrożenia musi zostać zweryfikowane przed włączeniem akcji.

Przepis na wywoływanie narzędzi

Odpowiedzi z dokumentów

Użyj własnego retrievera, dostarcz wybrane fragmenty i weryfikuj cytaty. Przykład wykorzystuje proste dopasowywanie tekstu; usługa osadzania nie jest dostępna.

Przepis na dokumenty
Przypadki użycia
Praktyczny punkt wyjścia

Zaplanuj swój pierwszy przepływ pracy.

Zdecyduj, czego potrzebuje Twoja aplikacja, zanim zwiększysz ruch lub dodasz więcej funkcji.

  1. Wybierz do zadania

    Porównaj możliwości, licencje modeli, kontekst i stawki wejścia/wyjścia. Sprawdź status usługi i potwierdzone limity wdrożenia przed kierowaniem żądań do modelu.

    Porównaj modele
  2. Przygotuj małe żądanie

    Użyj formatu chat-completions z dokładnym identyfikatorem modelu i ograniczonym wynikiem. Przeczytaj przewodniki o strumieniowaniu i błędach przed dodaniem ponowień lub narzędzi.

    Otwórz szybki start
  3. Spraw, aby wykorzystanie było zrozumiałe

    Oddzielaj aplikacje za pomocą odrębnych kluczy i limitów wydatków. Konsola to miejsce, w którym sprawdzisz wykorzystanie i dostępne środki, w tym kwoty zarezerwowane na oczekujące żądania.

    Poznaj konsolę
Jak to działa
Katalog modeli

Wybierz właściwy kompromis.

Porównaj opublikowane opcje poniżej, a następnie otwórz stronę modelu, aby poznać jego możliwości, licencję i uwagi dotyczące wdrożenia. Sama cena nie świadczy o jakości ani szybkości.

ModelWejścieWyjścieKontekst usługi
LLlama 3.1 8B0,03 USD0,05 USD131 072
QQwen3 32B0,15 USD0,20 USD131 072
DDeepSeek V30,25 USD0,85 USD131 072
DDeepSeek R10,50 USD2,15 USD131 072

Stawki wejścia i wyjścia podane są w USD za milion tokenów. Limity kontekstu usługi wymagają potwierdzenia wdrożenia; limity natywne modelu są odrębne.

Twoje istniejące narzędzia

Korzystaj z istniejących narzędzi.

Połącz znane narzędzia, korzystając z ich udokumentowanych ustawień. Zweryfikuj funkcje, których potrzebuje Twoja aplikacja, na wybranym wdrożeniu przed przeniesieniem ruchu.

Przeglądaj wszystkie integracje
Poznaj granice

Zrozum granice usługi.

Przejrzyj kontrolki konta, obsługę danych i wymagania wdrożeniowe przed wyborem modelu.

Zdefiniowana granica danych

Brama nie przechowuje promptów ani odpowiedzi. Przechowywanie u dostawcy i logowanie w infrastrukturze nadal wymagają weryfikacji; nie jest to gwarancja braku przechowywania od końca do końca.

Przeczytaj przegląd zaufania

Stawki, które możesz sprawdzić

Porównuj wejście i wyjście osobno i szacuj na podstawie własnego obciążenia. Dedykowana pojemność podlega innemu modelowi rezerwacji.

Poznaj ceny

Ścieżka przez problemy

Skorzystaj z przewodnika wsparcia, aby zdiagnozować błędy i przygotować raport. Sprawdź status usługi, aby uzyskać informacje o dostępności i monitorowaniu.

Otwórz przewodnik wsparcia
O nas
Zanim zaczniesz

Pytania przed rozpoczęciem.

Zrozum dostępność, kompatybilność, koszty i przetwarzanie danych, zanim wbudujesz je w swoją aplikację.

Czy muszę przejść KYC?

Bieżący proces logowania nie obejmuje przesyłania dokumentu tożsamości ani weryfikacji KYC. Wymagane jest zalogowane konto, a korzystanie pozostaje powiązane z tym kontem.

Czytaj więcej

Czy modele są nieocenzurowane?

WeightsAPI nie dodaje filtra treści na poziomie bramy. Katalog obejmuje oryginalne modele i warianty dostrojone opublikowane przez ich twórców, w tym Dolphin i Hermes. Niektóre warianty są zaprojektowane w celu ograniczenia odmów; trening modelu może nadal powodować odmowy. Przeczytaj notatki dotyczące źródła i zachowania każdego modelu.

Czytaj więcej

Co mogę dziś używać?

Zarządzaj kluczami API, twórz zamówienia na doładowania kryptowalutami i składaj zamówienia na dedykowane GPU. Sprawdzaj status usługi pod kątem dostępności modeli; akceptacja płatności i aktywacja GPU wymagają potwierdzenia.

Czytaj więcej

Co oznacza tutaj kompatybilność z OpenAI?

API korzysta z formatów Chat Completions, starszego Completions i tras wykrywania modeli. Sprawdź możliwości wybranego wdrożenia; API specyficzne dla dostawcy nie są wymienne.

Czytaj więcej

Jak wyceniane jest zapytanie do modelu?

Koszty wykorzystują oddzielne stawki modelu za rzeczywiste tokeny wejściowe i wyjściowe, rozliczane na podstawie użycia potwierdzonego przez dostawcę po wstępnej rezerwacji kredytu.

Czytaj więcej

Czy WeightsAPI przechowuje moje prompty lub odpowiedzi modelu?

Brama nie utrwala promptów ani odpowiedzi w swojej bazie danych aplikacji. Rekordy konta pozostają, a retencja dostawcy wymaga osobnej weryfikacji.

Czytaj więcej
Przeczytaj pełne FAQ

Wybierz model. Spraw, aby pierwsze żądanie było jasne.

Zacznij od katalogu i małego przykładu. Dokumentacja wyjaśnia format żądania; FAQ pomaga rozstrzygnąć związane z tym decyzje.