Sem KYC
Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.
Escolha modelos de pesos abertos publicados por meio de uma API compatível com OpenAI. Mantenha ferramentas familiares, compare custos de tokens e combine o modelo com sua carga de trabalho.
Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.
A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.
Escolha um modelo do catálogo, escreva um prompt curto e inspecione o código correspondente. Mantenha o primeiro exemplo simples para que a solicitação e a resposta esperada sejam fáceis de verificar.
Acesso à conta Faça login e confirme uma recarga de pelo menos USD 100, depois gaste seu crédito pré-pago. Cada recarga tem o mesmo mínimo; saldos restantes menores permanecem utilizáveis. Verifique o status do serviço para disponibilidade do modelo.
Verifique o acesso antes da sua primeira solicitação
Entre, confirme uma recarga de pelo menos USD 100 e selecione uma chave de API para enviar sua primeira solicitação.curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true,
"max_tokens": 512
}'* Contexto do serviço. Consulte a página do modelo para a janela nativa e os requisitos de configuração.
O cookbook oferece pequenos exemplos para você adaptar, com a aplicação ainda no controle.
Construa um loop de conversa, gerencie o histórico de mensagens e valide as respostas que seus usuários recebem. Comece com um exemplo no terminal antes de adicionar uma interface de usuário.
Explore um loop de chamada de ferramentas com uma lista de permissões explícita e verificações de argumentos. O suporte do modelo e da implantação deve ser verificado antes de habilitar ações.
Traga seu próprio recuperador, forneça passagens selecionadas e verifique as citações. O exemplo usa correspondência simples de texto; o serviço de embeddings não está disponível.
Decida o que sua aplicação precisa antes de aumentar o tráfego ou adicionar mais recursos.
Compare capacidades, licenças de modelo, contexto e taxas de entrada/saída. Verifique o status do serviço e os limites de implantação confirmados antes de encaminhar solicitações a um modelo.
Use o formato chat-completions com um ID de modelo exato e uma saída limitada. Leia os guias de streaming e erros antes de adicionar repetições ou ferramentas.
Separe aplicações com chaves distintas e limites de gastos. O console é o lugar para revisar o uso e o crédito disponível, incluindo valores reservados para solicitações pendentes.
Compare as opções publicadas abaixo e abra a página de um modelo para ver suas capacidades, licença e notas de implantação. O preço por si só não estabelece qualidade ou velocidade.
| Modelo | Entrada | Saída | Contexto do serviço |
|---|---|---|---|
| LLlama 3.1 8B | US$ 0,03 | US$ 0,05 | 131.072 |
| QQwen3 32B | US$ 0,15 | US$ 0,20 | 131.072 |
| DDeepSeek V3 | US$ 0,25 | US$ 0,85 | 131.072 |
| DDeepSeek R1 | US$ 0,50 | US$ 2,15 | 131.072 |
As taxas de entrada e saída são em USD por milhão de tokens. Os limites de contexto do serviço exigem confirmação da implantação; os limites nativos do modelo são separados.
Conecte ferramentas familiares usando suas configurações documentadas. Valide os recursos que seu aplicativo precisa na implantação selecionada antes de mover o tráfego.
Configure uma conexão de chat personalizada compatível com OpenAI e verifique a seleção do modelo antes de enviar uma mensagem de teste.
Configure uma conexão com a API OpenAI para uma interface de chat, com descoberta de modelos ou um filtro de modelo explícito.
Prepare o provedor OpenAI Compatible e alinhe contexto, limites de saída e configurações de capacidade com a implantação real.
Comece com um modelo de chat OpenAI em uma cadeia básica. Fluxos de trabalho de agente precisam de suporte a chamada de ferramentas verificado separadamente.
Revise os controles da conta, o tratamento de dados e os requisitos de implantação antes de escolher um modelo.
O gateway não persiste prompts ou respostas. A retenção do provedor e o registro de infraestrutura ainda precisam de verificação; isso não é uma garantia de retenção de ponta a ponta.
Compare entrada e saída separadamente e estime com sua própria carga de trabalho. Capacidade dedicada segue um modelo de reserva diferente.
Use o guia de suporte para diagnosticar erros e preparar um relatório. Verifique o status do serviço para disponibilidade e informações de monitoramento.
Entenda disponibilidade, compatibilidade, custos e tratamento de dados antes de incorporá-los à sua aplicação.
O fluxo de login atual não possui upload de documento de identidade ou etapa de verificação KYC. Uma conta logada ainda é necessária, e o uso permanece associado a essa conta.
O WeightsAPI não adiciona filtro de conteúdo no gateway. O catálogo inclui modelos originais e variantes com ajuste fino publicadas por seus respectivos criadores, incluindo Dolphin e Hermes. Algumas variantes são projetadas para reduzir recusas; o treinamento do modelo ainda pode causar recusas. Leia as notas de origem e comportamento de cada modelo.
Gerencie chaves de API, crie ordens de financiamento em cripto e faça pedidos de GPUs dedicadas. Verifique o status do serviço para disponibilidade de modelos; crédito de pagamento e ativação de GPU requerem confirmação.
A API usa rotas de Chat Completions, Completions legado e descoberta de modelos. Verifique as capacidades do deployment selecionado; APIs específicas de provedores não são intercambiáveis.
Os custos usam taxas de modelo separadas para tokens reais de entrada e saída, liquidados a partir do uso confirmado pelo provedor após uma reserva inicial de crédito.
O gateway não persiste prompts ou respostas em seu banco de dados de aplicação. Registros de conta permanecem, e a retenção do provedor requer verificação separada.
Comece com o catálogo e um pequeno exemplo. A documentação explica o formato da solicitação; o FAQ ajuda a resolver as decisões em torno dela.