weightsapi.推理控制台
导航
Dify

Dify

使用 WeightsAPI 的 OpenAI 兼容端点配置 Dify。

在连接之前#

AI 访问需要登录、至少 100 美元的一次性确认充值、授权的 API 密钥以及足够的可用余额来覆盖请求。每次后续充值的最低金额也是 100 美元;较小的剩余余额在足以覆盖请求时仍可使用。余额需要交易验证。在发送流量之前,请检查服务状态以了解模型可用性。 在密钥字段中使用您自己的 API 密钥,不含 Bearer 前缀。基础 URL 已包含 /v1。这些配置已对照官方文档进行检查,但未在实时 GPU 部署上进行测试。

配置#

安装官方 OpenAI-API-兼容 提供商(langgenius/openai_api_compatible)(如果尚未安装),然后在工作区模型-提供商设置下添加模型。LLM/聊天模型的字段:

字段
类型 LLM
模型名称 Qwen/Qwen3-32B
API 密钥 WEIGHTSAPI_API_KEY
API 基础 URL https://weightsapi.com/v1
补全模式 Chat
API 类型 Chat Completions API (/chat/completions)
模型上下文大小 实际部署上下文限制
最大 token 上限 实际部署输出限制
视觉支持 不支持(此模型仅支持文本)
函数调用类型 不支持,直到原生工具经过验证

底层凭据的确切名称是 api_keyendpoint_urlmode: chatapi_type: chat_completionscontext_sizemax_tokens_to_sample。可选的 API 端点的模型名称endpoint_model_name)可以覆盖发送的模型名称;如果模型名称已经匹配,请留空。对于此 LLM 方案,请使用包含 /v1 的基础 URL;此插件对非 LLM 类型有不同的路径处理,因此未经检查请勿将此方案扩展到 embeddings。

来源:官方市场列表官方提供商字段架构

验证连接#

获取模型列表,然后发送一条简短消息。模型列表成功并不证明支持工具、视觉或 JSON schema。启用这些功能前请检查所选部署的能力。