weightsapi.INFÉRENCEConsole
Navigation
Sans KYC · Sans filtre de contenu ajouté

Inférence LLM gérée. Modèles ouverts, une seule API.

Choisissez des modèles à poids ouverts publiés via une API compatible OpenAI. Gardez vos outils familiers, comparez les coûts des jetons et adaptez le modèle à votre charge de travail.

Sans KYC

Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.

Sans filtre de contenu ajouté

WeightsAPI n’ajoute aucun filtre de contenu à sa passerelle API. L’entraînement propre au modèle peut toutefois l’amener à refuser une demande.

Façonnez votre première requête.

Choisissez un modèle du catalogue, écrivez une petite invite et inspectez le code correspondant. Gardez le premier exemple simple afin que la requête et la réponse attendue soient faciles à vérifier.

Accès au compte Connectez-vous et attendez la confirmation d'un rechargement d'au moins 100 USD, puis dépensez votre crédit prépayé. Chaque recharge a le même minimum ; les soldes restants plus petits restent utilisables. Vérifiez la disponibilité des modèles dans le statut du service.

Bac à sableCompte approvisionné requis
128K contexte*
Vérification de l’accès au compte…
Le contenu de l’invite n’est pas enregistré par cette passerelle.
RéponsePrêt lorsque les vérifications du compte, de la clé et du service sont réussies

Vérifiez l’accès avant votre première demande

Connectez-vous, attendez la confirmation d'un rechargement d'au moins 100 USD et sélectionnez une clé API pour envoyer votre première requête.
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
La même demande, dans votre application.Lire le guide de démarrage rapide

* Contexte de service. Consultez la page du modèle pour la fenêtre native et les exigences de configuration.

Construisez autour de votre application

Commencez par une tâche utile.

Le recueil de recettes vous donne de petits exemples à adapter, tandis que l’application garde le contrôle.

Assistants conversationnels

Construisez une boucle de conversation, gérez l’historique des messages et validez les réponses que vos utilisateurs reçoivent. Commencez par un exemple en terminal avant d’ajouter une interface utilisateur.

Recette de chatbot

Code et outils

Explorez une boucle d’appel d’outils avec une liste blanche explicite et des vérifications d’arguments. La prise en charge du modèle et du déploiement doit être vérifiée avant d’activer des actions.

Recette d’appel d’outils

Réponses à partir de documents

Apportez votre propre récupérateur, fournissez des passages sélectionnés et vérifiez les citations. L’exemple utilise une correspondance de texte simple ; le service d’embeddings n’est pas disponible.

Recette de documents
Cas d'usage
Un point de départ pratique

Planifiez votre premier flux de travail.

Décidez de ce dont votre application a besoin avant d’augmenter le trafic ou d’ajouter plus de fonctionnalités.

  1. Choisissez pour la tâche

    Comparez les capacités, les licences des modèles, le contexte et les tarifs d'entrée/sortie. Consultez le statut du service et les limites de déploiement confirmées avant de router des requêtes vers un modèle.

    Comparez les modèles
  2. Préparez une petite requête

    Utilisez le format chat-completions avec un ID de modèle exact et une sortie limitée. Lisez les guides de streaming et d’erreurs avant d’ajouter des relances ou des outils.

    Ouvrez le guide de démarrage rapide
  3. Gardez une utilisation compréhensible

    Séparez les applications avec des clés distinctes et des plafonds de dépenses. La console est l’endroit pour examiner l’utilisation et le crédit disponible, y compris les montants réservés pour les requêtes en attente.

    Explorez la console
Fonctionnement
Catalogue de modèles

Choisissez le bon compromis.

Comparez les choix publiés ci-dessous, puis ouvrez une page de modèle pour ses capacités, sa licence et ses notes de déploiement. Le prix seul ne détermine pas la qualité ni la vitesse.

ModèleEntréeSortieContexte du service
LLlama 3.1 8B0,03 $US0,05 $US131 072
QQwen3 32B0,15 $US0,20 $US131 072
DDeepSeek V30,25 $US0,85 $US131 072
DDeepSeek R10,50 $US2,15 $US131 072

Les tarifs d'entrée et de sortie sont en USD par million de jetons. Les limites de contexte du service nécessitent une confirmation de déploiement ; les limites natives des modèles sont distinctes.

Vos outils existants

Apportez vos outils existants.

Connectez les outils familiers en utilisant leurs paramètres documentés. Validez les fonctionnalités dont votre application a besoin sur le déploiement sélectionné avant de déplacer le trafic.

Parcourir toutes les intégrations
Connaissez les limites

Comprenez les limites du service.

Examinez les contrôles du compte, le traitement des données et les exigences de déploiement avant de choisir un modèle.

Une frontière de données définie

La passerelle ne conserve pas les invites ni les réponses. La rétention par le fournisseur et la journalisation de l’infrastructure doivent encore être vérifiées ; ce n’est pas une garantie de rétention de bout en bout.

Lisez l’aperçu de confiance

Des tarifs que vous pouvez inspecter

Comparez l’entrée et la sortie séparément et estimez avec votre propre charge de travail. La capacité dédiée suit un modèle de réservation différent.

Explorez les tarifs

Un chemin à travers les problèmes

Utilisez le guide de support pour diagnostiquer les erreurs et préparer un rapport. Consultez le statut du service pour les informations de disponibilité et de surveillance.

Ouvrez le guide d’assistance
À propos
Avant de commencer

Questions avant de commencer.

Comprenez la disponibilité, la compatibilité, les coûts et le traitement des données avant de les intégrer dans votre application.

Faut-il passer une vérification KYC ?

Le parcours de connexion actuel ne demande ni dépôt de pièce d’identité ni vérification KYC. Un compte connecté reste nécessaire, et l’utilisation reste associée à ce compte.

Lire la suite

Les modèles sont-ils non censurés ?

WeightsAPI n'ajoute aucun filtre de contenu au niveau de la passerelle. Le catalogue comprend des modèles originaux et des variantes affinées publiées par leurs créateurs respectifs, notamment Dolphin et Hermes. Certaines variantes sont conçues pour réduire les refus ; l'entraînement du modèle peut encore provoquer des refus. Lisez les notes de source et de comportement de chaque modèle.

Lire la suite

Que puis-je utiliser aujourd'hui ?

Gérez les clés API, créez des commandes de financement en crypto et passez des commandes de GPU dédiés. Vérifiez l'état du service pour la disponibilité des modèles ; le crédit de paiement et l'activation du GPU nécessitent une confirmation.

Lire la suite

Que signifie compatible OpenAI ici ?

L'API utilise les routes Chat Completions, Completions héritées et découverte de modèles. Vérifiez les capacités du déploiement sélectionné ; les API spécifiques au fournisseur ne sont pas interchangeables.

Lire la suite

Comment une requête de modèle est-elle facturée ?

Le coût utilise les tarifs distincts des tokens d'entrée et de sortie. Après une réservation initiale de crédit, le montant final est calculé à partir de l'utilisation confirmée par le fournisseur.

Lire la suite

WeightsAPI stocke-t-il mes invites ou mes réponses de modèle ?

La passerelle ne persiste pas les invites ou les réponses dans sa base de données d'application. Les enregistrements de compte restent, et la rétention du fournisseur nécessite une vérification séparée.

Lire la suite
Lisez la FAQ complète

Choisissez un modèle. Rendez la première requête claire.

Commencez par le catalogue et un petit exemple. La documentation explique le format des requêtes ; la FAQ aide à résoudre les décisions qui l’entourent.