Sans KYC
Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.
Choisissez le bon équilibre entre capacités, contexte et coût.
Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.
WeightsAPI n’ajoute aucun filtre de contenu à sa passerelle API. L’entraînement propre au modèle peut toutefois l’amener à refuser une demande.
Sources des modèles publiés vérifiées 2026-09-04. Check service status for current availability. Liste des modèles API ↗
| Modèle | Entrée / 1M | Sortie / 1M | Contexte | Type |
|---|---|---|---|---|
| LLlama 3.1 8B | $0.03 | $0.05 | 128K* | Texte |
| DDeepSeek V4 Flash | $0.09 | $0.18 | 128K* | Texte |
| GGemma 3 27B | $0.10 | $0.15 | 128K* | Texte + images |
| MMistral Small 3 | $0.10 | $0.20 | 32K* | Texte |
| QQwen3-Coder-Next | $0.12 | $0.80 | 128K* | Texte |
| HHermes 4 70B | $0.13 | $0.40 | 128K* | Texte |
| MMistral Small 4 | $0.15 | $0.60 | 128K* | Texte + image |
| QQwen3 32B | $0.15 | $0.20 | 128K* | Texte |
| DDolphin Mistral 24B Venice Edition | $0.20 | $0.90 | 128K* | Texte + image |
| QQwen3 235B A22B | $0.20 | $0.60 | 128K* | Texte |
| DDeepSeek V3 | $0.25 | $0.85 | 128K* | Texte |
| LLlama 3.3 70B | $0.35 | $0.40 | 128K* | Texte |
| DDeepSeek R1 | $0.50 | $2.15 | 128K* | Texte |
| MMixtral 8×22B | $0.60 | $0.60 | 64K* | Texte |
| LLlama 3.1 405B | $1.20 | $1.20 | 128K* | Texte |
Classification rapide, extraction et chat léger.
Un modèle de texte pour le raisonnement à long contexte, le codage et les flux de travail d'outils, avec une fenêtre configurée de 1 048 576 jetons.
Compréhension d’images et conversation multilingue.
Tâches textuelles efficaces, appel de fonctions et chat en langues européennes.
Un modèle de codage uniquement texte pour l'exploration de bases de code et les flux de travail d'outils, avec un contexte natif publié de 262 144 tokens.
Conversation créative, jeu de rôle et raisonnement avec des instructions configurables, publié par Nous Research.
Un modèle Mistral officiel combinant entrée texte et image, appels d'outils et raisonnement configurable, avec une fenêtre publiée de 262 144 tokens.
Un choix équilibré pour le code, le chat multilingue et le raisonnement.
Conversations et personnages avec instructions contrôlées par l'application, de Dolphin et Venice.
Suivi d'instructions généraliste solide et utilisation d'outils.
Génération de code, instructions complexes et tâches structurées.
Assistants généralistes, synthèse et utilisation d'outils.
Raisonnement difficile, mathématiques et analyse de code.
Génération multilingue et flux de travail d'appel de fonctions.
Génération polyvalente exigeante et instructions complexes.