weightsapi.INFERENZAConsole
Navigazione
Nessun KYC · Nessun filtro contenuti aggiunto

Inferenza LLM gestita. Modelli aperti, una sola API.

Scegli modelli open-weight pubblicati tramite un'API compatibile con OpenAI. Mantieni gli strumenti familiari, confronta i costi dei token e abbina il modello al tuo carico di lavoro.

Nessun KYC

Nessun caricamento di documenti d'identità o passaggio KYC nell'attuale procedura di accesso. L'accesso e l'utilizzo rimangono collegati al tuo account.

Nessun filtro contenuti aggiunto

WeightsAPI non aggiunge alcun filtro contenuti a livello di gateway. L'addestramento proprio del modello può comunque portarlo a rifiutare una richiesta.

Definisci la tua prima richiesta.

Scegli un modello dal catalogo, scrivi un prompt breve e ispeziona il codice corrispondente. Mantieni semplice il primo esempio, così la richiesta e la risposta attesa sono facili da verificare.

Acesso à conta Entre e confirme um recarga de pelo menos USD 100, depois gaste seu crédito pré-pago. Cada recarga tem o mesmo mínimo; saldos restantes menores permanecem utilizáveis. Verifique o status do serviço para disponibilidade do modelo.

PlaygroundAccount finanziato richiesto
128K contesto*
Verifica dell'accesso all'account…
Il contenuto del prompt non viene salvato da questo gateway.
RispostaPronto quando i controlli di account, chiave e servizio sono superati

Verifica l'accesso prima della tua prima richiesta

Accedi, conferma una ricarica di almeno 100 USD e seleziona una chiave API per inviare la tua prima richiesta.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
La stessa richiesta, nella tua applicazione.Leggi la guida rapida

* Contesto del servizio. Consulta la pagina del modello per la finestra nativa e i requisiti di configurazione.

Costruisci intorno alla tua applicazione

Inizia con un'attività utile.

Il ricettario fornisce piccoli esempi da adattare, mantenendo il controllo all'applicazione.

Assistenti conversazionali

Costruisci un ciclo di conversazione, gestisci la cronologia dei messaggi e convalida le risposte che ricevono i tuoi utenti. Inizia con un esempio da terminale prima di aggiungere un'interfaccia utente.

Ricetta per chatbot

Programmazione e strumenti

Esplora un ciclo di chiamate di strumenti con un elenco consentito esplicito e controlli sugli argomenti. Il supporto del modello e del deployment deve essere verificato prima di abilitare le azioni.

Ricetta per chiamate di strumenti

Risposte dai documenti

Porta il tuo retriever, fornisci i passaggi selezionati e verifica le citazioni. L'esempio utilizza un semplice confronto testuale; il servizio di embedding non è disponibile.

Ricetta per documenti
Casi d'uso
Un punto di partenza pratico

Pianifica il tuo primo flusso di lavoro.

Decidi cosa serve alla tua applicazione prima di aumentare il traffico o aggiungere altre funzionalità.

  1. Escolha para a tarefa

    Compare capacidades, licenças de modelo, contexto e taxas de entrada/saída. Verifique o status do serviço e os limites de implantação confirmados antes de rotear solicitações para um modelo.

    Confronta i modelli
  2. Prepara una richiesta piccola

    Usa il formato chat-completions con un ID modello esatto e un output limitato. Leggi le guide su streaming ed errori prima di aggiungere retry o strumenti.

    Apri la guida rapida
  3. Mantieni comprensibile l'utilizzo

    Separa le applicazioni con chiavi distinte e limiti di spesa. La console è il posto per esaminare utilizzo e credito disponibile, inclusi gli importi riservati per le richieste in sospeso.

    Esplora la console
Come funziona
Catalogo modelli

Scegli il giusto compromesso.

Confronta le scelte pubblicate di seguito, quindi apri la pagina di un modello per le sue capacità, la licenza e le note sul deployment. Il prezzo da solo non determina qualità o velocità.

ModelloInputOutputContesto del servizio
LLlama 3.1 8B0,03 USD0,05 USD131.072
QQwen3 32B0,15 USD0,20 USD131.072
DDeepSeek V30,25 USD0,85 USD131.072
DDeepSeek R10,50 USD2,15 USD131.072

As taxas de entrada e saída são em USD por milhão de tokens. Os limites de contexto do serviço exigem confirmação da implantação; os limites nativos do modelo são separados.

I tuoi strumenti esistenti

Traga suas ferramentas existentes.

Conecte ferramentas familiares usando suas configurações documentadas. Valide os recursos que sua aplicação precisa na implantação selecionada antes de mover o tráfego.

Sfoglia tutte le integrazioni
Conosci i limiti

Entenda os limites do serviço.

Revise os controles da conta, o tratamento de dados e os requisitos de implantação antes de escolher um modelo.

Un confine dati definito

Il gateway non conserva prompt o risposte. La conservazione da parte del provider e la registrazione dell'infrastruttura richiedono ancora verifica; questa non è una garanzia di conservazione end-to-end.

Leggi la panoramica sull'affidabilità

Tariffe che puoi ispezionare

Confronta input e output separatamente e stima con il tuo carico di lavoro. La capacità dedicata segue un modello di prenotazione diverso.

Esplora i prezzi

Um caminho através de problemas

Use o guia de suporte para diagnosticar erros e preparar um relatório. Verifique o status do serviço para disponibilidade e informações de monitoramento.

Apri la guida di supporto
Informazioni
Prima di iniziare

Domande prima di iniziare.

Comprendi disponibilità, compatibilità, costi e gestione dei dati prima di integrarli nella tua applicazione.

Devo completare il KYC?

L'attuale procedura di accesso non prevede caricamento di documenti d'identità o verifica KYC. È comunque richiesto un account con accesso effettuato e l'utilizzo rimane associato a tale account.

Leggi di più

I modelli sono senza censura?

WeightsAPI non aggiunge filtri di contenuto a livello di gateway. Il catalogo include modelli originali e varianti fine-tuned pubblicati dai rispettivi creatori, inclusi Dolphin e Hermes. Alcune varianti sono progettate per ridurre i rifiuti; l'addestramento del modello può comunque causare rifiuti. Leggi la fonte e le note sul comportamento di ciascun modello.

Leggi di più

Cosa posso usare oggi?

Gestisci le chiavi API, crea ordini di finanziamento in criptovaluta e effettua ordini di GPU dedicate. Controlla lo stato del servizio per la disponibilità dei modelli; il credito di pagamento e l'attivazione della GPU richiedono conferma.

Leggi di più

Cosa significa compatibile con OpenAI qui?

L'API usa i percorsi Chat Completions, Completions legacy e di scoperta dei modelli. Controlla le capacità del deployment selezionato; le API specifiche del provider non sono intercambiabili.

Leggi di più

Come viene prezzata una richiesta al modello?

I costi usano tariffe separate per modello per token di input e output effettivi, saldati dall'utilizzo confermato dal provider dopo una prenotazione iniziale di credito.

Leggi di più

WeightsAPI memorizza i miei prompt o le risposte dei modelli?

Il gateway non persiste prompt o risposte nel suo database applicativo. I record del conto rimangono, e la conservazione del provider richiede una verifica separata.

Leggi di più
Leggi le FAQ complete

Scegli un modello. Rendi chiara la prima richiesta.

Inizia con il catalogo e un piccolo esempio. I documenti spiegano il formato della richiesta; le FAQ aiutano a risolvere le decisioni correlate.