Solicitações pagas#
Não há um limite fixo de solicitações por minuto por padrão no produto. A admissão ainda está sujeita a saldo, tetos de chave, disponibilidade de modelo e capacidade física. Um endpoint dedicado reserva a máquina; capacidade compartilhada pode entrar em fila.
Playground financiado pela conta#
Entre e confirme uma recarga de pelo menos USD 100 antes do uso da IA. Cada recarga posterior tem o mesmo mínimo; após a qualificação, um saldo restante menor permanece utilizável quando cobre a solicitação. Permissões de chave, limites de gastos e disponibilidade de modelos ainda se aplicam. Pagamentos pendentes não desbloqueiam o acesso. Verifique o status do serviço antes de enviar solicitações.
Janelas de contexto#
A entrada mais os tokens gerados devem caber no contexto da implantação configurada. As janelas nativas publicadas do modelo e os tetos de serviço são mostrados separadamente.
Capacidade dedicada#
Máquinas dedicadas usam um preço mensal pré-pago sem cobranças por token. A taxa de transferência permanece limitada pela máquina e pela carga de trabalho. A disponibilidade de hardware e o provisionamento exigem confirmação; o período de serviço começa na ativação.
Exemplo de solicitação
curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true
}'