weightsapi.INFERENCIAConsola
Navegación
Sin KYC · Sin filtros de contenido añadidos

Inferencia LLM gestionada. Modelos abiertos, una API.

Elija modelos publicados de pesos abiertos a través de una API compatible con OpenAI. Conserve las herramientas conocidas, compare costos por token y ajuste el modelo a su carga de trabajo.

Sin KYC

No se requiere cargar documento de identidad ni realizar un paso KYC en el flujo de inicio de sesión actual. El acceso y el uso siguen vinculados a su cuenta.

Sin filtros de contenido añadidos

WeightsAPI no añade ningún filtro de contenido a nivel de puerta de enlace. El propio entrenamiento de un modelo puede hacer que rechace una solicitud.

Dé forma a su primera solicitud.

Elija un modelo del catálogo, escriba un prompt pequeño e inspeccione el código correspondiente. Mantenga el primer ejemplo simple para que la solicitud y la respuesta esperada sean fáciles de comprobar.

Acesso à conta Entre e confirme uma recarga de pelo menos USD 100, depois gaste seu crédito pré-pago. Cada recarga tem o mesmo mínimo; saldos restantes menores permanecem utilizáveis. Verifique o status do serviço para disponibilidade do modelo.

Zona de pruebasSe requiere cuenta financiada
128K contexto*
Comprobando el acceso a la cuenta…
El contenido del prompt no se guarda en esta pasarela.
RespuestaListo cuando pasen las comprobaciones de cuenta, clave y servicio

Comprueba el acceso antes de tu primera solicitud

Inicie sesión, confirme una recarga de al menos USD 100 y seleccione una clave API para enviar su primera solicitud.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
La misma solicitud, en tu aplicación.Lee la guía de inicio rápido

* Contexto del servicio. Consulte la página del modelo para conocer la ventana nativa y los requisitos de configuración.

Construya alrededor de su aplicación

Comience con una tarea útil.

El recetario le ofrece pequeños ejemplos para adaptar, con la aplicación siempre en control.

Asistentes conversacionales

Construya un bucle de conversación, gestione el historial de mensajes y valide las respuestas que reciben sus usuarios. Comience con un ejemplo de terminal antes de añadir una interfaz de usuario.

Receta de chatbot

Programación y herramientas

Explore un bucle de llamada a herramientas con una lista de permitidos explícita y verificaciones de argumentos. El soporte del modelo y del despliegue debe verificarse antes de habilitar acciones.

Receta de llamada a herramientas

Respuestas a partir de documentos

Aporte su propio recuperador, proporcione pasajes seleccionados y verifique las citas. El ejemplo utiliza coincidencia de texto simple; el servicio de embeddings no está disponible.

Receta de documentos
Casos de uso
Un punto de partida práctico

Planifique su primer flujo de trabajo.

Decida qué necesita su aplicación antes de aumentar el tráfico o añadir más funciones.

  1. Escolha para a tarefa

    Compare capacidades, licenças de modelo, contexto e taxas de entrada/saída. Verifique o status do serviço e os limites de implantação confirmados antes de rotear solicitações para um modelo.

    Compare modelos
  2. Prepare una solicitud pequeña

    Use el formato de chat-completions con un ID de modelo exacto y una salida acotada. Lea las guías de streaming y errores antes de añadir reintentos o herramientas.

    Abra la guía de inicio rápido
  3. Mantenga el uso comprensible

    Separe las aplicaciones con claves distintas y límites de gasto. La consola es el lugar para revisar el uso y el crédito disponible, incluidas las cantidades reservadas para solicitudes pendientes.

    Explore la consola
Cómo funciona
Catálogo de modelos

Elija la compensación adecuada.

Compare las opciones publicadas a continuación y luego abra la página de un modelo para conocer sus capacidades, licencia y notas de despliegue. El precio por sí solo no establece la calidad ni la velocidad.

ModeloEntradaSalidaContexto del servicio
LLlama 3.1 8B0,03 US$0,05 US$131.072
QQwen3 32B0,15 US$0,20 US$131.072
DDeepSeek V30,25 US$0,85 US$131.072
DDeepSeek R10,50 US$2,15 US$131.072

As taxas de entrada e saída são em USD por milhão de tokens. Os limites de contexto do serviço exigem confirmação da implantação; os limites nativos do modelo são separados.

Sus herramientas existentes

Traga suas ferramentas existentes.

Conecte ferramentas familiares usando suas configurações documentadas. Valide os recursos que seu aplicativo precisa na implantação selecionada antes de mover o tráfego.

Examinar todas las integraciones
Conozca los límites

Entenda os limites do serviço.

Revise os controles da conta, o manuseio de dados e os requisitos de implantação antes de escolher um modelo.

Un límite de datos definido

La puerta de enlace no persiste prompts ni respuestas. La retención del proveedor y el registro de infraestructura aún necesitan verificación; esto no es una garantía de retención de extremo a extremo.

Lea la descripción general de confianza

Tarifas que puede inspeccionar

Compare la entrada y la salida por separado y calcule con su propia carga de trabajo. La capacidad dedicada sigue un modelo de reserva diferente.

Explore los precios

Um caminho através dos problemas

Use o guia de suporte para diagnosticar erros e preparar um relatório. Verifique o status do serviço para disponibilidade e informações de monitoramento.

Abra la guía de soporte
Acerca de
Antes de comenzar

Preguntas antes de comenzar.

Comprenda la disponibilidad, la compatibilidad, los costos y el manejo de datos antes de incorporarlos a su aplicación.

¿Necesito completar el KYC?

El flujo de inicio de sesión actual no incluye carga de documento de identidad ni paso de verificación KYC. Aun así, se requiere una cuenta con sesión iniciada y el uso sigue asociado a esa cuenta.

Leer más

¿Los modelos no están censurados?

WeightsAPI no agrega ningún filtro de contenido en la puerta de enlace. El catálogo incluye modelos originales y variantes ajustadas publicadas por sus respectivos creadores, incluyendo Dolphin y Hermes. Algunas variantes están diseñadas para reducir negativas; el entrenamiento del modelo aún puede causar negativas. Lee las notas de origen y comportamiento de cada modelo.

Leer más

¿Qué puedo utilizar hoy?

Administre claves API, cree órdenes de financiación con criptomonedas y realice pedidos de GPU dedicadas. Verifique el estado del servicio para conocer la disponibilidad de los modelos; el crédito de pago y la activación de la GPU requieren confirmación.

Leer más

¿Qué significa aquí compatible con OpenAI?

La API utiliza los formatos de solicitud de Chat Completions, Completions heredadas y descubrimiento de modelos. Verifique las capacidades del despliegue seleccionado; las API específicas del proveedor no son intercambiables.

Leer más

¿Cómo se valora una solicitud de modelo?

Los costos utilizan tarifas de modelo separadas para los tokens reales de entrada y salida, que se liquidan a partir del uso confirmado por el proveedor después de una reserva de crédito inicial.

Leer más

¿WeightsAPI almacena mis prompts o respuestas del modelo?

La puerta de enlace no persiste prompts ni respuestas en su base de datos de aplicaciones. Los registros de cuenta permanecen, y la retención del proveedor requiere verificación por separado.

Leer más
Lea las preguntas frecuentes completas

Elija un modelo. Haga clara la primera solicitud.

Comience con el catálogo y un ejemplo pequeño. La documentación explica el formato de la solicitud; las preguntas frecuentes ayudan a resolver las decisiones relacionadas.