weightsapi.INFERENZAConsole
Navigazione
Catalogo dei modelli

Catalogo dei modelli

Scegli il giusto equilibrio tra capacità, contesto e costi.

Nessun KYC

Nessun caricamento di documenti d'identità o passaggio KYC nell'attuale procedura di accesso. L'accesso e l'utilizzo rimangono collegati al tuo account.

Nessun filtro contenuti aggiunto

WeightsAPI non aggiunge alcun filtro contenuti a livello di gateway. L'addestramento proprio del modello può comunque portarlo a rifiutare una richiesta.

15 modelli a pesi aperti. Versioni pubblicate dai rispettivi sviluppatori.

Fonti dei modelli pubblicate verificate 2026-09-04. Check service status for current availability. Elenco modelli API ↗

ModelloInput / 1MOutput / 1MContestoTipo
LLlama 3.1 8B$0.03$0.05128K*Testo
DDeepSeek V4 Flash$0.09$0.18128K*Testo
GGemma 3 27B$0.10$0.15128K*Testo + immagini
MMistral Small 3$0.10$0.2032K*Testo
QQwen3-Coder-Next$0.12$0.80128K*Testo
HHermes 4 70B$0.13$0.40128K*Testo
MMistral Small 4$0.15$0.60128K*Testo + immagine
QQwen3 32B$0.15$0.20128K*Testo
DDolphin Mistral 24B Venice Edition$0.20$0.90128K*Testo + immagine
QQwen3 235B A22B$0.20$0.60128K*Testo
DDeepSeek V3$0.25$0.85128K*Testo
LLlama 3.3 70B$0.35$0.40128K*Testo
DDeepSeek R1$0.50$2.15128K*Testo
MMixtral 8×22B$0.60$0.6064K*Testo
LLlama 3.1 405B$1.20$1.20128K*Testo

Scegli per carico di lavoro

Llama 3.1 8B

Classificazione rapida, estrazione e chat leggera.

$0.03 / $0.05Llama 3.1 Community

DeepSeek V4 Flash

Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho com ferramentas, com uma janela configurada de 1.048.576 tokens.

$0.09 / $0.18MIT

Gemma 3 27B

Comprensione delle immagini e conversazione multilingue.

$0.10 / $0.15Gemma Terms of Use

Mistral Small 3

Attività di testo efficienti, chiamate di funzione e chat in lingue europee.

$0.10 / $0.20Apache 2.0

Qwen3-Coder-Next

Un modello di codifica solo testuale per l'esplorazione di codebase e flussi di lavoro con strumenti, con un contesto nativo pubblicato di 262.144 token.

$0.12 / $0.80Apache 2.0

Hermes 4 70B

Conversazione creativa, gioco di ruolo e ragionamento con istruzioni configurabili, pubblicato da Nous Research.

$0.13 / $0.40Meta Llama Community

Mistral Small 4

Un modello Mistral ufficiale che combina input di testo e immagini, chiamate di strumenti e ragionamento configurabile, con una finestra pubblicata di 262.144 token.

$0.15 / $0.60Apache 2.0

Qwen3 32B

Una scelta equilibrata per codice, chat multilingue e ragionamento.

$0.15 / $0.20Apache 2.0

Dolphin Mistral 24B Venice Edition

Conversazioni e personaggi con istruzioni controllate dall'applicazione, da Dolphin e Venice.

$0.20 / $0.90Apache 2.0

Qwen3 235B A22B

Forte capacità di seguire istruzioni generiche e utilizzo di strumenti.

$0.20 / $0.60Apache 2.0

DeepSeek V3

Generazione di codice, istruzioni complesse e attività strutturate.

$0.25 / $0.85MIT

Llama 3.3 70B

Assistenti generici, riassunto e uso di strumenti.

$0.35 / $0.40Llama 3.3 Community

DeepSeek R1

Ragionamento difficile, matematica e analisi del codice.

$0.50 / $2.15MIT

Mixtral 8×22B

Generazione multilingue e flussi di lavoro con chiamate di funzione.

$0.60 / $0.60Apache 2.0

Llama 3.1 405B

Generazione generica impegnativa e istruzioni complesse.

$1.20 / $1.20Llama 3.1 Community