weightsapi.INFERENCIAConsola
Navegación
Preguntas frecuentes

Preguntas frecuentes

Respuestas prácticas sobre el acceso a WeightsAPI, la integración de API, el crédito criptográfico, la facturación y el manejo de datos.

De un vistazo

Respuestas claras sobre el acceso, los modelos, los costos, los datos y la disponibilidad del servicio.

Primeros pasos

Comprenda qué está disponible hoy y prepare su primera integración.

¿Qué puedo utilizar hoy?

Administre claves API, cree órdenes de financiación con criptomonedas y realice pedidos de GPU dedicadas. Verifique el estado del servicio para conocer la disponibilidad de los modelos; el crédito de pago y la activación de la GPU requieren confirmación.

Explore el catálogo de modelos y la documentación, inicie sesión en la consola y cree o revoque claves API. El pago con criptomonedas indica el monto, la red, la dirección y la fecha límite de pago; el crédito requiere una transacción verificada. Las órdenes dedicadas se pueden realizar y pagar con crédito confirmado, y el hardware se activa después del aprovisionamiento. Consulte el estado y la guía de inicio rápido antes de enviar solicitudes de modelos.

Inicie sesión y confirme una recarga de al menos 100 USD antes de usar la IA. Cada recarga posterior tiene el mismo mínimo; después de la habilitación, un saldo restante menor sigue siendo utilizable si cubre la solicitud. Siguen aplicándose los permisos de las claves, los límites de gasto y la disponibilidad de los modelos. Los pagos pendientes no habilitan el acceso. Consulte el estado del servicio antes de enviar solicitudes.

¿Necesito completar el KYC?

El flujo de inicio de sesión actual no incluye carga de documento de identidad ni paso de verificación KYC. Aun así, se requiere una cuenta con sesión iniciada y el uso sigue asociado a esa cuenta.

¿Cómo creo una cuenta y una clave API?

Inicie sesión en la consola, cree una clave con controles de gasto y de modelos, y copie su secreto de inmediato, ya que solo se muestra una vez.

Inicie sesión en la consola y cree una clave con nombre, un límite de gasto positivo y, si es útil, una lista de modelos permitidos. Copie el secreto cuando aparezca: la consola lo revela solo en el momento de la creación. Guárdelo en una variable de entorno del lado del servidor o en un administrador de secretos. Las claves controlan el acceso; también se requieren crédito disponible y un modelo disponible. Consulte autenticación.

¿Qué necesito para mi primera solicitud exitosa?

Utilice un modelo disponible, una clave autorizada y suficiente crédito confirmado. Elija un ID de modelo exacto y mantenga la salida dentro de los límites del despliegue.

Utilice la URL base de la guía de inicio rápido, envíe su clave API como token Bearer y elija un ID de modelo exacto devuelto por /v1/models. Establezca un límite de tokens de salida que se ajuste a su presupuesto y a la ventana de contexto del despliegue. Consulte el estado del servicio antes de enviar solicitudes.

El acceso a la IA requiere iniciar sesión, una recarga confirmada de al menos 100 USD, una clave API autorizada y suficiente crédito disponible para la solicitud. Cada recarga posterior también tiene un mínimo de 100 USD; los saldos restantes menores siguen siendo utilizables si cubren la solicitud. El crédito requiere verificación de la transacción. Consulte el estado del servicio para conocer la disponibilidad de los modelos antes de enviar tráfico.

¿Puedo reutilizar una integración existente de OpenAI o Anthropic?

OpenAI Chat Completions necesita una nueva URL base, clave y modelo; Anthropic también requiere cambios en el SDK, el formato de mensajes y el análisis de respuestas.

Para una integración de OpenAI Chat Completions, los cambios principales son la URL base, la clave de API y el ID del modelo. Las API y funciones específicas del proveedor requieren comprobaciones separadas. Una integración de Anthropic también necesita cambios en el SDK, el formato de mensajes, la ubicación del mensaje del sistema y el análisis de respuestas. Siga la guía de migración y luego pruebe prompts representativos, herramientas y salidas estructuradas contra una implementación conectada antes de mover tráfico. La compatibilidad con un formato de solicitud conocido no garantiza un comportamiento idéntico del modelo.

¿Cómo debo elegir un modelo?

Evalúe el modelo más pequeño adecuado en sus propias tareas y luego verifique su disponibilidad, límites de contexto y soporte requerido de herramientas o esquemas.

Comience por la tarea: chat interactivo corto, codificación, razonamiento o entrada de documentos más larga. Compare las páginas de modelos para conocer las especificaciones del editor, el contexto del servicio y las tarifas de entrada/salida. Verifique la disponibilidad del modelo y evalúe el candidato más pequeño adecuado en sus propias tareas. Verifique el soporte de llamada de herramientas o de esquemas por separado antes de comprometer una aplicación a un modelo.

Modelos y funciones de la API

Compruebe el alcance de la compatibilidad y los requisitos de cada función.

¿Los modelos no están censurados?

WeightsAPI no agrega ningún filtro de contenido en la puerta de enlace. El catálogo incluye modelos originales y variantes ajustadas publicadas por sus respectivos creadores, incluyendo Dolphin y Hermes. Algunas variantes están diseñadas para reducir negativas; el entrenamiento del modelo aún puede causar negativas. Lee las notas de origen y comportamiento de cada modelo.

¿Qué significa aquí compatible con OpenAI?

La API utiliza los formatos de solicitud de Chat Completions, Completions heredadas y descubrimiento de modelos. Verifique las capacidades del despliegue seleccionado; las API específicas del proveedor no son intercambiables.

WeightsAPI acepta los formatos de solicitud de Chat Completions, Completions heredadas y descubrimiento de modelos. La generación requiere un despliegue disponible que soporte la operación seleccionada. Las respuestas, los asistentes y las herramientas específicas del proveedor no son reemplazos directos. Consulte la referencia de la API para conocer las operaciones soportadas y luego valide las funciones que utiliza su aplicación antes de cambiar el tráfico.

¿La API admite respuestas transmitidas?

Utilice eventos enviados por el servidor para respuestas de chat transmitidas en un despliegue disponible y conserve el registro de uso final para la facturación.

Establezca stream: true para un despliegue de chat disponible y consuma eventos completos enviados por el servidor. Un fragmento de red no es necesariamente un mensaje, y el registro de uso final puede llegar después de que termine el texto de la respuesta. Mantenga la clave API en su servidor al reenviar una transmisión a un navegador. La guía de transmisión cubre el uso y las conexiones interrumpidas; consulte el estado del servicio para conocer la disponibilidad.

¿Puede un modelo llamar herramientas o ejecutar acciones para mi aplicación?

Su aplicación valida y ejecuta las llamadas a herramientas. El modelo y el despliegue seleccionados deben admitir el formato de herramientas antes de poder habilitar las acciones.

La puerta de enlace reenvía las definiciones de herramientas al modelo seleccionado. Un modelo puede devolver el nombre de una herramienta solicitada y sus argumentos; su aplicación decide si ejecutar la acción. Valide ambos contra una lista permitida y los permisos del usuario actual, y luego devuelva el resultado en la conversación. WeightsAPI no ejecuta las herramientas de su aplicación. Verifique el soporte del despliegue y siga llamada de funciones antes de habilitar acciones.

¿Puedo exigir que una respuesta coincida con un esquema JSON?

El JSON estricto requiere un despliegue con decodificación restringida compatible. Valide cada respuesta contra su esquema y maneje explícitamente la salida no válida o incompleta.

La salida de esquema estricto requiere decodificación restringida y soporte para su esquema en el despliegue seleccionado. Pedir a un modelo que “devuelva JSON” por sí solo no garantiza una coincidencia con el esquema. La puerta de enlace reenvía response_format; confirme el soporte de modo estricto para el despliegue antes de confiar en él. Siga la guía de salida estructurada, valide cada resultado con el mismo esquema y maneje explícitamente el truncamiento o el rechazo.

¿Están disponibles los servicios de embeddings, lotes, audio e imágenes?

Consulte la referencia de la API y el estado del servicio antes de usar embeddings, reranking, procesamiento por lotes administrado, transcripción de audio o generación de imágenes.

Estas operaciones necesitan su propio despliegue compatible. Una capacidad o tarifa listada no establece un endpoint activo, y enviar múltiples solicitudes de chat desde su aplicación es diferente de una API de lotes administrada. Consulte la referencia de la API y el estado del servicio antes de diseñar en torno a un servicio auxiliar.

Depósitos de criptomonedas

Lea el activo, la red y el estado de pago exactos antes de enviar fondos.

¿Qué criptomonedas y redes puedo utilizar?

Utilice las opciones de activo y red que se muestran en la configuración de pago actual; una dirección de recepción mostrada no establece crédito confirmado.

Elija exactamente el activo y la red que se muestran en el proceso de pago y utilice la dirección de recepción guardada con su orden. Un token en otra red no es intercambiable. La orden conserva su activo, red y dirección incluso si la configuración de pago cambia. El crédito aparece solo después de que la transacción entrante se haya cotejado y verificado. Consulte facturación.

¿Cómo agrego crédito con criptomonedas?

El proceso de pago calcula el monto en criptomonedas para su recarga en USD y muestra la dirección de recepción fija, la red, el tipo de cambio y la fecha límite de pago.

Cree una orden de financiación por al menos 100 USD. El servidor obtiene una tasa de mercado reciente y fija el monto a enviar durante 10 minutos, incluso para USDT y USDC. Conserve la referencia de la orden y pague las tarifas de red por separado. El cotejo de la transacción y la confirmación del crédito siguen siendo pasos verificados separados; crear una orden o actualizar su estado no agrega crédito. Consulte la guía de facturación.

¿Por qué un depósito puede permanecer pendiente?

Una orden permanece pendiente hasta que su transferencia se coteje, verifique y acredite. Iniciar un pago o actualizar su estado no lo confirma.

Una orden comienza en un estado de espera de confirmación. Su transferencia debe cotejarse y verificarse antes de registrar el crédito en la cuenta. Una declaración de pago o una actualización de estado no puede marcarlo como pagado. Conserve la referencia de la orden y el identificador público de la transacción, y no envíe otro pago solo porque el primero esté pendiente. La guía de soporte enumera los detalles que debe conservar; los tiempos de confirmación y resolución no están garantizados.

¿Qué ocurre si envío el activo equivocado o uso la red equivocada?

La recuperación y los reembolsos por transferencias de activo o red equivocados no están establecidos; use el destino exacto registrado en su orden de fondos.

No se ha establecido una política de recuperación para transferencias de red o activo equivocados. No asuma que una transferencia puede acreditarse, recuperarse o reembolsarse. Antes de transferir, verifique el activo, la red, la dirección y el importe con las instrucciones de depósito actuales antes de enviar. Si ocurre un problema con la transferencia, proporcione la referencia de la orden y el identificador público de transacción a través de soporte; nunca comparta una frase semilla de billetera ni una clave privada.

¿Cómo se calcula el monto en criptomoneda y cuándo expira?

El objetivo en USD se convierte a una tasa de mercado reciente. El monto en criptomoneda se redondea hacia arriba a la unidad más pequeña del activo y se fija durante 10 minutos.

El pago muestra la fuente de la tasa, la marca de tiempo de la tasa y la fecha límite de pago. USDT y USDC usan sus tasas de mercado reales, no una paridad asumida de un dólar. Si no hay una tasa reciente disponible, reintente el cálculo antes de enviar fondos. Un pedido existente sin cotización puede recibir una sin cambiar su referencia o dirección.

Después del vencimiento, obtenga una nueva cotización solo si aún no ha enviado fondos. Conserve el pedido original para una transferencia ya enviada; las confirmaciones pueden llegar más tarde. Un pago exacto recibido dentro de su ventana de cotización califica para el crédito en USD cotizado después de la verificación. Las transferencias tardías o con montos diferentes requieren revisión; un pago pendiente no desbloquea el acceso a la IA. Consulte facturación.

Facturación y claves de API

Comprenda los cargos por uso, el crédito reservado y los controles de cada clave.

¿Cómo se valora una solicitud de modelo?

Los costos utilizan tarifas de modelo separadas para los tokens reales de entrada y salida, que se liquidan a partir del uso confirmado por el proveedor después de una reserva de crédito inicial.

La inferencia compartida tiene tarifas de entrada y salida separadas para cada modelo. Una solicitud admitida reserva crédito suficiente para la entrada contada y la salida máxima solicitada, y luego se liquida contra el uso autoritativo a las tarifas guardadas con esa reserva. Utilice la tabla de precios para estimar su carga de trabajo. Los modelos sin precios publicados no pueden aceptar solicitudes pagadas. Una solicitud rechazada antes del envío de la inferencia no genera un cargo por tokens. Consulte facturación.

¿Por qué mi crédito disponible puede ser menor que mi saldo?

El crédito disponible es el saldo contable menos las reservas de inferencia pendientes, que permanecen retenidas hasta que se pueda liquidar el uso autoritativo.

El saldo proviene del libro mayor de la cuenta; el crédito disponible también resta las reservas de inferencia pendientes. Una reserva retiene el costo máximo admitido de la solicitud para que las solicitudes concurrentes no puedan gastar el mismo crédito. Cuando llega el uso autoritativo, el cargo final reemplaza la retención. Si un stream se rompe o falta el uso del proveedor, esa reserva puede permanecer pendiente de conciliación. Un cliente desconectado no prueba que la generación se haya detenido. Consulte streaming y facturación, e informe una retención no resuelta a través de soporte.

¿Qué protegen los límites de gasto y las restricciones de modelos?

Los límites de gasto cubren el uso de por vida de cada clave y las reservas pendientes, mientras que las listas permitidas de modelos restringen sus modelos permitidos; los límites no se restablecen mensualmente.

Cada clave tiene un límite de gasto de por vida en USD que incluye el uso registrado y las reservas pendientes. No se restablece mensualmente. Una lista permitida de modelos limita los ID de modelo exactos que la clave puede usar; una lista vacía permite todos los modelos disponibles del catálogo. Utilice claves separadas para distinguir aplicaciones y entornos en los registros de uso. Los controles de clave no agregan crédito a la cuenta ni cambian la disponibilidad de los modelos. Consulte autenticación.

¿Qué debo hacer si pierdo o expongo una clave de API?

Revoque de inmediato una clave expuesta, cree una de reemplazo y actualice su aplicación; los secretos existentes no se pueden volver a mostrar.

La consola no puede volver a mostrar un secreto existente. Cree una clave de reemplazo, guárdela de forma segura, actualice las aplicaciones que la usan y revoque la clave antigua. Si la clave fue expuesta, revóquela de inmediato e inspeccione los registros de uso de la cuenta. La revocación impide que se admitan nuevas solicitudes con esa clave; el trabajo ya admitido todavía puede liquidarse. Nunca pegue una clave de API en un mensaje de soporte, repositorio público o paquete de navegador. Siga la guía de autenticación.

¿Puedo retirar crédito no utilizado u obtener un reembolso automático?

Los retiros de billetera no están disponibles actualmente. El crédito confirmado puede pagar el uso del servicio; cancelar una orden de GPU antes de la activación devuelve su pago al saldo de su cuenta.

Los retiros de billetera no están disponibles actualmente. Utilice crédito prepago confirmado para solicitudes de modelos elegibles u órdenes de GPU dedicadas. Cancelar una orden de GPU pagada antes de la activación devuelve ese pago de alquiler al saldo de su cuenta de WeightsAPI; no envía criptomonedas a una billetera. No se promete ningún reembolso automático ni pago a billetera. Revise facturación antes de agregar crédito.

Datos y privacidad

Separe el manejo de los prompts de los registros necesarios para operar una cuenta.

¿WeightsAPI almacena mis prompts o respuestas del modelo?

La puerta de enlace no persiste prompts ni respuestas en su base de datos de aplicaciones. Los registros de cuenta permanecen, y la retención del proveedor requiere verificación por separado.

La puerta de enlace no persiste prompts, texto de finalización ni argumentos de herramientas en su base de datos de aplicaciones, y los registros de la aplicación omiten los cuerpos de las solicitudes. Los registros de autenticación, uso y pago se almacenan por separado. La retención del proveedor y el registro de infraestructura requieren verificación independiente; el comportamiento de la puerta de enlace no es una garantía de retención cero de extremo a extremo. Lea manejo de datos y la página de confianza para conocer el alcance.

¿Qué registros se conservan si el contenido del prompt no se registra?

Los identificadores de cuenta, los hashes de claves, los registros de pago, los recuentos de tokens, los cargos y los metadatos de reserva se conservan para autenticación y contabilidad sin almacenar el texto de la conversación.

El sistema de cuenta conserva identificadores, hashes de claves de API y metadatos, registros de depósitos y retiros, recuentos de tokens, cargos y agregados de uso. Las reservas de solicitudes también registran el modelo, las tarifas aplicables y el estado de liquidación para que la facturación se pueda conciliar. Estos registros respaldan la autenticación, los controles de gasto y la contabilidad sin almacenar el texto de la conversación. Por lo tanto, “sin registro de contenido” no significa uso anónimo ni ausencia de registros conservados. Consulte manejo de datos; los períodos de retención y los procedimientos de derechos de datos en producción aún necesitan términos publicados y verificados.

Los pedidos de GPU dedicadas conservan el hardware y el modelo seleccionados, el precio mensual, el estado de pago y cancelación, y las fechas de servicio y detalles del endpoint cuando se confirma el aprovisionamiento.

¿La declaración de privacidad también cubre al proveedor de inferencia?

No: la política de contenido de la puerta de enlace no establece las prácticas de retención o entrenamiento de un proveedor de inferencia, que aún requieren verificación.

El comportamiento de la puerta de enlace no establece la política de retención o entrenamiento de otro proveedor. Atender una solicitud requiere compartir su contenido con el proveedor de inferencia. El registro del proveedor, los subprocesadores y los términos contractuales requieren verificación por separado. Si su carga de trabajo tiene requisitos de confidencialidad o regulatorios, revise la página de confianza y confirme los acuerdos pertinentes antes de enviar contenido sensible.

¿Dónde se procesarán las solicitudes y puedo elegir una región?

Dallas, Ashburn y Portland son ubicaciones planificadas, sin disponibilidad de flota verificada, región seleccionada por el cliente ni compromiso de residencia de datos en producción.

Dallas, Ashburn y Portland son ubicaciones objetivo para GPU. La disponibilidad, el enrutamiento y la residencia de datos requieren confirmación para el despliegue real; los nombres de ubicación por sí solos no establecen estas condiciones. La elección de región y los compromisos de residencia de extremo a extremo deben acordarse para el despliegue. Revise manejo de datos y la página de confianza antes de comprometer una carga de trabajo con requisitos regionales.

¿Se requiere una recarga confirmada antes de usar la IA?

Cada interacción con IA requiere una recarga confirmada que cumpla los requisitos; el mínimo es de 100 USD por recarga, no un saldo mínimo permanente.

Sí. Su cuenta debe recibir una recarga confirmada de al menos 100 USD antes de cualquier interacción con IA; no se ofrece ningún cupo público de prueba gratuita. Cada recarga posterior también comienza en 100 USD. Después de la recarga inicial que cumpla los requisitos, el crédito restante por debajo de 100 USD aún puede pagar solicitudes hasta que sea insuficiente. Utilice una clave activa con los permisos de modelo y el presupuesto requeridos. El proceso de pago proporciona instrucciones de pago y una cotización de criptomonedas con tiempo limitado. El crédito requiere una transacción cotejada y verificada; crear o actualizar una orden no confirma el pago.

Rendimiento y soporte

Planifique la capacidad con cuidado y reúna detalles útiles cuando algo falle.

¿Qué latencia o rendimiento puedo esperar?

El rendimiento depende del modelo, el hardware, la carga de trabajo, la configuración de servicio y la concurrencia. Valídelo con su propia carga de trabajo; no se ofrece ninguna garantía de latencia o rendimiento.

El rendimiento depende del modelo, el hardware, la longitud del prompt, la longitud generada, la concurrencia y la configuración de servicio. En un despliegue disponible, mida el tiempo hasta el primer token y la velocidad de generación por separado utilizando una carga de trabajo representativa. Las características publicadas del modelo y las especificaciones del hardware no constituyen un SLA. Revise capacidad dedicada para cargas de trabajo que necesiten recursos reservados y estado del servicio para la disponibilidad.

¿Las solicitudes son ilimitadas si tengo suficiente crédito?

El crédito no hace que el uso sea ilimitado: la capacidad, el contexto, los límites de salida, los permisos de modelo y los límites de gasto de cada clave siguen restringiendo las solicitudes.

No. El diseño actual no impone un límite de producto fijo predeterminado de solicitudes por minuto al tráfico de pago, pero la admisión sigue dependiendo del crédito disponible, los límites de clave, los modelos permitidos, los límites de salida, el tamaño del contexto y la capacidad del backend. El servicio compartido puede poner en cola, y el playground sigue las mismas reglas de recarga confirmada, crédito disponible y presupuesto de clave que las solicitudes de la API. La ventana de contexto nativa de un modelo también puede superar el techo de servicio configurado. Revise límites y gestione errores con reintentos limitados; no trate el crédito como una garantía de capacidad.

¿Puedo pedir un endpoint de GPU dedicada ahora?

Sí. Elija una GPU, seleccione un modelo y realice un pedido mensual. El pago se realiza con crédito de cuenta confirmado; el hardware estará disponible después de que se confirme el aprovisionamiento.

Utilice la página de GPU dedicada para elegir una configuración y abrir el proceso de pago. Si su saldo es insuficiente, recárguelo en criptomonedas y regrese una vez que el crédito esté confirmado para pagar el pedido. Una recarga no paga el alquiler automáticamente. El mes prepago comienza en la activación, sin renovación automática. Antes de la activación, la cancelación devuelve cualquier pago de alquiler al saldo de su cuenta. La disponibilidad del hardware y el tiempo de entrega requieren confirmación del operador; un pedido no es una máquina activa.

¿Cómo debo interpretar la página de estado y un error 503?

Un 503 significa que el servicio requerido no está disponible. Verifique el estado del servicio y el mensaje de error antes de reintentar; una configuración de conexión no establece tiempo de actividad.

Un 503 service_unavailable significa que el despliegue requerido o el servicio auxiliar no puede aceptar la solicitud. Consulte la página de estado y la guía de errores antes de usar reintentos limitados. Una configuración de conexión por sí sola no es prueba de un servicio saludable ni del tiempo de actividad medido. Las solicitudes rechazadas antes del envío de la inferencia no generan un cargo por tokens.

¿Qué información debo incluir al pedir ayuda?

Incluya la operación, la hora y la zona horaria, el modelo, el código de error y las referencias pertinentes; elimine las claves API, los secretos de billetera y el contenido innecesario del prompt.

Utilice la página de soporte para preparar la operación afectada, la hora aproximada y la zona horaria, el ID del modelo, el código de error y el resultado esperado. Para facturación o depósitos, agregue la referencia de la solicitud u orden y el identificador público de la transacción cuando corresponda. Elimine las claves API, los secretos de billetera y el contenido innecesario del prompt. Copiar un informe no lo envía. Los contactos oficiales de soporte, los horarios de atención y los objetivos de respuesta no están publicados.

¿Necesitas un siguiente paso?

Encuentra la guía correspondiente o prepara los detalles de tu problema.

Abrir soporte