weightsapi.INFÉRENCEConsole
Navigation
Catalogue de modèles

Catalogue de modèles

Choisissez le bon équilibre entre capacités, contexte et coût.

Sans KYC

Aucun dépôt de pièce d’identité ni étape KYC dans le parcours de connexion actuel. L’accès et l’utilisation restent liés à votre compte.

Sans filtre de contenu ajouté

WeightsAPI n’ajoute aucun filtre de contenu à sa passerelle API. L’entraînement propre au modèle peut toutefois l’amener à refuser une demande.

15 modèles à poids ouverts. Versions publiées par leurs éditeurs.

Sources des modèles publiés vérifiées 2026-09-04. Check service status for current availability. Liste des modèles API ↗

ModèleEntrée / 1MSortie / 1MContexteType
LLlama 3.1 8B$0.03$0.05128K*Texte
DDeepSeek V4 Flash$0.09$0.18128K*Texte
GGemma 3 27B$0.10$0.15128K*Texte + images
MMistral Small 3$0.10$0.2032K*Texte
QQwen3-Coder-Next$0.12$0.80128K*Texte
HHermes 4 70B$0.13$0.40128K*Texte
MMistral Small 4$0.15$0.60128K*Texte + image
QQwen3 32B$0.15$0.20128K*Texte
DDolphin Mistral 24B Venice Edition$0.20$0.90128K*Texte + image
QQwen3 235B A22B$0.20$0.60128K*Texte
DDeepSeek V3$0.25$0.85128K*Texte
LLlama 3.3 70B$0.35$0.40128K*Texte
DDeepSeek R1$0.50$2.15128K*Texte
MMixtral 8×22B$0.60$0.6064K*Texte
LLlama 3.1 405B$1.20$1.20128K*Texte

Choisir par charge de travail

Llama 3.1 8B

Classification rapide, extraction et chat léger.

$0.03 / $0.05Llama 3.1 Community

DeepSeek V4 Flash

Un modèle de texte pour le raisonnement à long contexte, le codage et les flux de travail d'outils, avec une fenêtre configurée de 1 048 576 jetons.

$0.09 / $0.18MIT

Gemma 3 27B

Compréhension d’images et conversation multilingue.

$0.10 / $0.15Gemma Terms of Use

Mistral Small 3

Tâches textuelles efficaces, appel de fonctions et chat en langues européennes.

$0.10 / $0.20Apache 2.0

Qwen3-Coder-Next

Un modèle de codage uniquement texte pour l'exploration de bases de code et les flux de travail d'outils, avec un contexte natif publié de 262 144 tokens.

$0.12 / $0.80Apache 2.0

Hermes 4 70B

Conversation créative, jeu de rôle et raisonnement avec des instructions configurables, publié par Nous Research.

$0.13 / $0.40Meta Llama Community

Mistral Small 4

Un modèle Mistral officiel combinant entrée texte et image, appels d'outils et raisonnement configurable, avec une fenêtre publiée de 262 144 tokens.

$0.15 / $0.60Apache 2.0

Qwen3 32B

Un choix équilibré pour le code, le chat multilingue et le raisonnement.

$0.15 / $0.20Apache 2.0

Dolphin Mistral 24B Venice Edition

Conversations et personnages avec instructions contrôlées par l'application, de Dolphin et Venice.

$0.20 / $0.90Apache 2.0

Qwen3 235B A22B

Suivi d'instructions généraliste solide et utilisation d'outils.

$0.20 / $0.60Apache 2.0

DeepSeek V3

Génération de code, instructions complexes et tâches structurées.

$0.25 / $0.85MIT

Llama 3.3 70B

Assistants généralistes, synthèse et utilisation d'outils.

$0.35 / $0.40Llama 3.3 Community

DeepSeek R1

Raisonnement difficile, mathématiques et analyse de code.

$0.50 / $2.15MIT

Mixtral 8×22B

Génération multilingue et flux de travail d'appel de fonctions.

$0.60 / $0.60Apache 2.0

Llama 3.1 405B

Génération polyvalente exigeante et instructions complexes.

$1.20 / $1.20Llama 3.1 Community