weightsapi.INFÉRENCEConsole
Navigation
Dify

Dify

Configurez Dify avec le point de terminaison compatible OpenAI de WeightsAPI.

Avant de vous connecter#

L'accès à l'IA nécessite une connexion, un premier rechargement confirmé d'au moins 100 USD, une clé API autorisée et suffisamment de crédit disponible pour la requête. Chaque rechargement ultérieur a également un minimum de 100 USD ; les soldes restants plus petits restent utilisables lorsqu'ils couvrent la requête. Le crédit nécessite une vérification de transaction. Consultez le statut du service pour la disponibilité des modèles avant d'envoyer du trafic. Utilisez votre propre clé API sans le préfixe Bearer dans les champs de clé. L'URL de base comprend déjà /v1. Ces configurations ont été vérifiées par rapport à la documentation officielle, pas testées contre un déploiement GPU en direct.

Configuration#

Installez le fournisseur officiel OpenAI-API-compatible (langgenius/openai_api_compatible) s'il est absent, puis ajoutez le modèle dans les paramètres du fournisseur de modèles de l'espace de travail. Champs pour un modèle LLM/chat :

Champ Valeur
Type LLM
Nom du modèle Qwen/Qwen3-32B
Clé API WEIGHTSAPI_API_KEY
URL de base de l'API https://weightsapi.com/v1
Mode de complétion Chat
Type d'API API Chat Completions (/chat/completions)
Taille de contexte du modèle Limite de contexte réelle du déploiement
Limite supérieure pour max tokens Limite de sortie réelle du déploiement
Prise en charge de la vision Non pris en charge pour ce modèle textuel uniquement
Type d'appel de fonction Non pris en charge tant que les outils natifs ne sont pas vérifiés

Les noms de justificatifs sous-jacents exacts sont api_key, endpoint_url, mode: chat, api_type: chat_completions, context_size et max_tokens_to_sample. Un nom de modèle pour le point de terminaison API optionnel (endpoint_model_name) peut remplacer le nom de modèle envoyé ; laissez vide lorsque le nom de modèle correspond déjà. Utilisez l'URL de base incluant /v1 pour cette recette LLM ; ce plugin gère différemment les chemins pour les types non-LLM, donc n'étendez pas cette recette aux embeddings sans vérification.

Sources : Liste officielle de la place de marché, schéma officiel des champs du fournisseur.

Vérifier la connexion#

Récupérez la liste des modèles, puis envoyez un message court. Une récupération réussie de la liste des modèles ne prouve pas la prise en charge des outils, de la vision ou du schéma JSON. Vérifiez les capacités du déploiement sélectionné avant de les activer.