weightsapi.推理控制台
导航
LibreChat

LibreChat

使用 WeightsAPI 的 OpenAI 兼容端点配置 LibreChat。

在连接之前#

AI 访问需要登录、至少 100 美元的一次性确认充值、授权的 API 密钥以及足够的可用余额来覆盖请求。每次后续充值的最低金额也是 100 美元;较小的剩余余额在足以覆盖请求时仍可使用。余额需要交易验证。在发送流量之前,请检查服务状态以了解模型可用性。 在密钥字段中使用您自己的 API 密钥,不含 Bearer 前缀。基础 URL 已包含 /v1。这些配置已对照官方文档进行检查,但未在实时 GPU 部署上进行测试。

配置#

librechat.yaml 中配置自定义端点;将其环境变量提供给 LibreChat 服务器,在需要的位置挂载此配置,然后重启 LibreChat。

endpoints:
  custom:
    - name: "Managed inference"
      apiKey: "${WEIGHTSAPI_API_KEY}"
      baseURL: "${https://weightsapi.com/v1}"
      models:
        default: ["Qwen/Qwen3-32B"]
        fetch: false
      titleConvo: false
      modelDisplayLabel: "Qwen3 32B"

apiKeybaseURLmodels.default 是文档中记载的自定义端点字段。fetch: false 使用显式模型列表。省略 provider 会使用 OpenAI 兼容客户端。titleConvo: false 可避免额外的标题生成调用。请将此内容合并到现有文件中,并保留已安装版本的顶层配置版本。

来源:自定义端点结构配置安装

验证连接#

获取模型列表,然后发送一条简短消息。模型列表成功并不证明支持工具、视觉或 JSON schema。启用这些功能前请检查所选部署的能力。