Sans KYC
Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.
Choisissez des modèles à poids ouverts publiés via une API compatible OpenAI. Gardez vos outils familiers, comparez les coûts des jetons et adaptez le modèle à votre charge de travail.
Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.
WeightsAPI n’ajoute aucun filtre de contenu à sa passerelle API. L’entraînement propre au modèle peut toutefois l’amener à refuser une demande.
Choisissez un modèle du catalogue, écrivez une petite invite et inspectez le code correspondant. Gardez le premier exemple simple afin que la requête et la réponse attendue soient faciles à vérifier.
Accès au compte Connectez-vous et attendez la confirmation d'un rechargement d'au moins 100 USD, puis dépensez votre crédit prépayé. Chaque recharge a le même minimum ; les soldes restants plus petits restent utilisables. Vérifiez la disponibilité des modèles dans le statut du service.
Vérifiez l’accès avant votre première demande
Connectez-vous, attendez la confirmation d'un rechargement d'au moins 100 USD et sélectionnez une clé API pour envoyer votre première requête.curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true,
"max_tokens": 512
}'* Contexte de service. Consultez la page du modèle pour la fenêtre native et les exigences de configuration.
Le recueil de recettes vous donne de petits exemples à adapter, tandis que l’application garde le contrôle.
Construisez une boucle de conversation, gérez l’historique des messages et validez les réponses que vos utilisateurs reçoivent. Commencez par un exemple en terminal avant d’ajouter une interface utilisateur.
Explorez une boucle d’appel d’outils avec une liste blanche explicite et des vérifications d’arguments. La prise en charge du modèle et du déploiement doit être vérifiée avant d’activer des actions.
Apportez votre propre récupérateur, fournissez des passages sélectionnés et vérifiez les citations. L’exemple utilise une correspondance de texte simple ; le service d’embeddings n’est pas disponible.
Décidez de ce dont votre application a besoin avant d’augmenter le trafic ou d’ajouter plus de fonctionnalités.
Comparez les capacités, les licences des modèles, le contexte et les tarifs d'entrée/sortie. Consultez le statut du service et les limites de déploiement confirmées avant de router des requêtes vers un modèle.
Utilisez le format chat-completions avec un ID de modèle exact et une sortie limitée. Lisez les guides de streaming et d’erreurs avant d’ajouter des relances ou des outils.
Séparez les applications avec des clés distinctes et des plafonds de dépenses. La console est l’endroit pour examiner l’utilisation et le crédit disponible, y compris les montants réservés pour les requêtes en attente.
Comparez les choix publiés ci-dessous, puis ouvrez une page de modèle pour ses capacités, sa licence et ses notes de déploiement. Le prix seul ne détermine pas la qualité ni la vitesse.
| Modèle | Entrée | Sortie | Contexte du service |
|---|---|---|---|
| LLlama 3.1 8B | 0,03 $US | 0,05 $US | 131 072 |
| QQwen3 32B | 0,15 $US | 0,20 $US | 131 072 |
| DDeepSeek V3 | 0,25 $US | 0,85 $US | 131 072 |
| DDeepSeek R1 | 0,50 $US | 2,15 $US | 131 072 |
Les tarifs d'entrée et de sortie sont en USD par million de jetons. Les limites de contexte du service nécessitent une confirmation de déploiement ; les limites natives des modèles sont distinctes.
Connectez les outils familiers en utilisant leurs paramètres documentés. Validez les fonctionnalités dont votre application a besoin sur le déploiement sélectionné avant de déplacer le trafic.
Configurez une connexion de chat personnalisée compatible OpenAI et vérifiez la sélection du modèle avant d’envoyer un message de test.
Configurez une connexion API OpenAI pour une interface de chat, avec découverte de modèles ou un filtre de modèle explicite.
Préparez le fournisseur OpenAI Compatible et alignez le contexte, les limites de sortie et les paramètres de capacité avec le déploiement réel.
Commencez par un modèle de chat OpenAI dans une chaîne de base. Les flux de travail d’agents nécessitent une prise en charge de l’appel d’outils vérifiée séparément.
Examinez les contrôles du compte, le traitement des données et les exigences de déploiement avant de choisir un modèle.
La passerelle ne conserve pas les invites ni les réponses. La rétention par le fournisseur et la journalisation de l’infrastructure doivent encore être vérifiées ; ce n’est pas une garantie de rétention de bout en bout.
Comparez l’entrée et la sortie séparément et estimez avec votre propre charge de travail. La capacité dédiée suit un modèle de réservation différent.
Utilisez le guide de support pour diagnostiquer les erreurs et préparer un rapport. Consultez le statut du service pour les informations de disponibilité et de surveillance.
Comprenez la disponibilité, la compatibilité, les coûts et le traitement des données avant de les intégrer dans votre application.
Le parcours de connexion actuel ne demande ni dépôt de pièce d’identité ni vérification KYC. Un compte connecté reste nécessaire, et l’utilisation reste associée à ce compte.
WeightsAPI n'ajoute aucun filtre de contenu au niveau de la passerelle. Le catalogue comprend des modèles originaux et des variantes affinées publiées par leurs créateurs respectifs, notamment Dolphin et Hermes. Certaines variantes sont conçues pour réduire les refus ; l'entraînement du modèle peut encore provoquer des refus. Lisez les notes de source et de comportement de chaque modèle.
Gérez les clés API, créez des commandes de financement en crypto et passez des commandes de GPU dédiés. Vérifiez l'état du service pour la disponibilité des modèles ; le crédit de paiement et l'activation du GPU nécessitent une confirmation.
L'API utilise les routes Chat Completions, Completions héritées et découverte de modèles. Vérifiez les capacités du déploiement sélectionné ; les API spécifiques au fournisseur ne sont pas interchangeables.
Le coût utilise les tarifs distincts des tokens d'entrée et de sortie. Après une réservation initiale de crédit, le montant final est calculé à partir de l'utilisation confirmée par le fournisseur.
La passerelle ne persiste pas les invites ou les réponses dans sa base de données d'application. Les enregistrements de compte restent, et la rétention du fournisseur nécessite une vérification séparée.
Commencez par le catalogue et un petit exemple. La documentation explique le format des requêtes ; la FAQ aide à résoudre les décisions qui l’entourent.