Sem KYC
Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.
Escolha o equilíbrio certo entre capacidade, contexto e custo.
Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.
A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.
Fontes de modelos publicadas verificadas 2026-09-04. Check service status for current availability. Lista de modelos da API ↗
| Modelo | Entrada / 1M | Saída / 1M | Contexto | Tipo |
|---|---|---|---|---|
| LLlama 3.1 8B | $0.03 | $0.05 | 128K* | Texto |
| DDeepSeek V4 Flash | $0.09 | $0.18 | 128K* | Texto |
| GGemma 3 27B | $0.10 | $0.15 | 128K* | Texto + imagens |
| MMistral Small 3 | $0.10 | $0.20 | 32K* | Texto |
| QQwen3-Coder-Next | $0.12 | $0.80 | 128K* | Texto |
| HHermes 4 70B | $0.13 | $0.40 | 128K* | Texto |
| MMistral Small 4 | $0.15 | $0.60 | 128K* | Texto + imagem |
| QQwen3 32B | $0.15 | $0.20 | 128K* | Texto |
| DDolphin Mistral 24B Venice Edition | $0.20 | $0.90 | 128K* | Texto + imagem |
| QQwen3 235B A22B | $0.20 | $0.60 | 128K* | Texto |
| DDeepSeek V3 | $0.25 | $0.85 | 128K* | Texto |
| LLlama 3.3 70B | $0.35 | $0.40 | 128K* | Texto |
| DDeepSeek R1 | $0.50 | $2.15 | 128K* | Texto |
| MMixtral 8×22B | $0.60 | $0.60 | 64K* | Texto |
| LLlama 3.1 405B | $1.20 | $1.20 | 128K* | Texto |
Classificação rápida, extração e chat leve.
Um modelo de texto para raciocínio de contexto longo, codificação e fluxos de trabalho de ferramentas, com uma janela configurada de 1.048.576 tokens.
Compreensão de imagem e conversação multilíngue.
Tarefas de texto eficientes, chamada de funções e chat em idiomas europeus.
Um modelo de codificação somente texto para exploração de base de código e fluxos de trabalho com ferramentas, com um contexto nativo publicado de 262.144 tokens.
Conversa criativa, roleplay e raciocínio com instruções configuráveis, publicado pela Nous Research.
Um modelo oficial da Mistral combinando entrada de texto e imagem, chamada de ferramentas e raciocínio configurável, com uma janela publicada de 262.144 tokens.
Uma escolha equilibrada para código, chat multilíngue e raciocínio.
Conversas e personagens com instruções controladas pelo aplicativo, da Dolphin e da Venice.
Forte seguimento de instruções de propósito geral e uso de ferramentas.
Geração de código, instruções complexas e tarefas estruturadas.
Assistentes de propósito geral, sumarização e uso de ferramentas.
Raciocínio difícil, matemática e análise de código.
Geração multilíngue e fluxos de trabalho de chamada de funções.
Geração de uso geral exigente e instruções complexas.