weightsapi.INFERÊNCIAConsole
Navegação
Sobre o WeightsAPI

Sobre o WeightsAPI

Como a WeightsAPI aborda inferência gerenciada, capacidade compartilhada e dedicada, escolha de modelos e controles de conta.

Visão geral

Inferência gerenciada para desenvolvedores que trabalham com modelos de pesos abertos. Explore o serviço, seus princípios e as etapas da escolha do modelo à implantação.

Uma rota familiar para modelos de pesos abertos

A WeightsAPI reúne seleção de modelos, acesso à API e planejamento de capacidade para modelos de pesos abertos publicados. A inferência gerenciada coloca o fornecimento do modelo atrás de uma API para que um aplicativo possa solicitar uma resposta sem operar as máquinas subjacentes. Pesos abertos tornam um modelo disponível para inspeção ou implantação sob sua licença; eles não significam que todos os modelos tenham os mesmos direitos, comportamentos ou capacidades. O catálogo reúne essas diferenças para que você escolha deliberadamente.

Para pessoas que criam aplicações úteis

Construtores independentes, equipes de desenvolvimento e equipes de produto frequentemente precisam das mesmas primeiras respostas: qual modelo se adequa à tarefa, quanto uma solicitação pode custar e como ela se encaixará em uma aplicação existente. O WeightsAPI organiza esse ponto de partida em torno de um playground, páginas de modelos e exemplos práticos. Seja explorando um assistente, um fluxo de trabalho de codificação ou processamento de documentos, comece com um pequeno exemplo representativo e critérios de sucesso claros antes de dedicar mais tempo ou tráfego.

Duas maneiras de planejar a capacidade de inferência

A inferência compartilhada usa taxas de tokens de entrada e saída e atende a cargas de trabalho variáveis. A oferta dedicada fornece pedidos mensais para uma carga de trabalho definida, sujeita a confirmação de hardware disponível e escopo de implantação. Proteja credenciais, decida quais dados enviar, verifique os resultados gerados e controle as ações tomadas a partir deles. Um endpoint gerenciado tem capacidade finita. Compare os dois usando sua carga de trabalho, compatibilidade de modelo e informações de preços.

Torne os detalhes importantes visíveis

Identificadores exatos de modelo, taxas visíveis de entrada e saída e limites documentados ajudam você a avaliar cada opção. As páginas de modelo distinguem especificações do publicador de limites de serviço que exigem confirmação de implantação. Verifique a disponibilidade separadamente do catálogo e valide o comportamento que seu aplicativo precisa. A página de confiança explica o tratamento de dados e controles de conta.

O que você pode usar hoje

Navegue pelo catálogo, compare preços publicados, leia a documentação e gerencie chaves de API após entrar. Faça um pedido de GPU dedicada, pague com crédito de conta confirmado e acompanhe seu status até a confirmação do provisionamento. O checkout de criptomoedas fornece instruções de pagamento; o crédito requer verificação da transação. Verifique o status do serviço para disponibilidade de modelos e o FAQ para etapas de conta e pagamento.

Saiba com quem entrar em contato antes de se comprometer

WeightsAPI é o nome do serviço. A página de suporte fornece orientação de solução de problemas e um relatório que você pode copiar; copiar não envia uma solicitação. Detalhes oficiais do operador e de contato não foram publicados. Confirme o operador, os termos aplicáveis e os acordos de tratamento de dados antes de assumir um compromisso de serviço.

Precisa de um próximo passo?

Encontre o guia relevante ou prepare os detalhes do seu problema.

Abrir suporte