weightsapi.INFERÊNCIAConsole
Navegação
Catálogo de modelos

Catálogo de modelos

Escolha o equilíbrio certo entre capacidade, contexto e custo.

Sem KYC

Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.

Sem filtros de conteúdo adicionais

A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.

15 modelos de pesos abertos. Versões publicadas pelos seus criadores.

Fontes de modelos publicadas verificadas 2026-09-04. Check service status for current availability. Lista de modelos da API ↗

ModeloEntrada / 1MSaída / 1MContextoTipo
LLlama 3.1 8B$0.03$0.05128K*Texto
DDeepSeek V4 Flash$0.09$0.18128K*Texto
GGemma 3 27B$0.10$0.15128K*Texto + imagens
MMistral Small 3$0.10$0.2032K*Texto
QQwen3-Coder-Next$0.12$0.80128K*Texto
HHermes 4 70B$0.13$0.40128K*Texto
MMistral Small 4$0.15$0.60128K*Texto + imagem
QQwen3 32B$0.15$0.20128K*Texto
DDolphin Mistral 24B Venice Edition$0.20$0.90128K*Texto + imagem
QQwen3 235B A22B$0.20$0.60128K*Texto
DDeepSeek V3$0.25$0.85128K*Texto
LLlama 3.3 70B$0.35$0.40128K*Texto
DDeepSeek R1$0.50$2.15128K*Texto
MMixtral 8×22B$0.60$0.6064K*Texto
LLlama 3.1 405B$1.20$1.20128K*Texto

Escolha por carga de trabalho

Llama 3.1 8B

Classificação rápida, extração e chat leve.

$0.03 / $0.05Llama 3.1 Community

DeepSeek V4 Flash

Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho de ferramentas, com uma janela configurada de 1.048.576 tokens.

$0.09 / $0.18MIT

Gemma 3 27B

Compreensão de imagem e conversação multilíngue.

$0.10 / $0.15Gemma Terms of Use

Mistral Small 3

Tarefas de texto eficientes, chamada de funções e chat em idiomas europeus.

$0.10 / $0.20Apache 2.0

Qwen3-Coder-Next

Um modelo de codificação somente texto para exploração de base de código e fluxos de trabalho com ferramentas, com um contexto nativo publicado de 262.144 tokens.

$0.12 / $0.80Apache 2.0

Hermes 4 70B

Conversa criativa, roleplay e raciocínio com instruções configuráveis, publicado pela Nous Research.

$0.13 / $0.40Meta Llama Community

Mistral Small 4

Um modelo oficial da Mistral combinando entrada de texto e imagem, chamada de ferramentas e raciocínio configurável, com uma janela publicada de 262.144 tokens.

$0.15 / $0.60Apache 2.0

Qwen3 32B

Uma escolha equilibrada para código, chat multilíngue e raciocínio.

$0.15 / $0.20Apache 2.0

Dolphin Mistral 24B Venice Edition

Conversas e personagens com instruções controladas pelo aplicativo, da Dolphin e da Venice.

$0.20 / $0.90Apache 2.0

Qwen3 235B A22B

Forte seguimento de instruções de propósito geral e uso de ferramentas.

$0.20 / $0.60Apache 2.0

DeepSeek V3

Geração de código, instruções complexas e tarefas estruturadas.

$0.25 / $0.85MIT

Llama 3.3 70B

Assistentes de propósito geral, sumarização e uso de ferramentas.

$0.35 / $0.40Llama 3.3 Community

DeepSeek R1

Raciocínio difícil, matemática e análise de código.

$0.50 / $2.15MIT

Mixtral 8×22B

Geração multilíngue e fluxos de trabalho de chamada de funções.

$0.60 / $0.60Apache 2.0

Llama 3.1 405B

Geração de uso geral exigente e instruções complexas.

$1.20 / $1.20Llama 3.1 Community