在连接之前#
AI 访问需要登录、至少 100 美元的一次性确认充值、授权的 API 密钥以及足够的可用余额来覆盖请求。每次后续充值的最低金额也是 100 美元;较小的剩余余额在足以覆盖请求时仍可使用。余额需要交易验证。在发送流量之前,请检查服务状态以了解模型可用性。 在密钥字段中使用您自己的 API 密钥,不含 Bearer 前缀。基础 URL 已包含 /v1。这些配置已对照官方文档进行检查,但未在实时 GPU 部署上进行测试。
配置#
安装官方 OpenAI-API-兼容 提供商(langgenius/openai_api_compatible)(如果尚未安装),然后在工作区模型-提供商设置下添加模型。LLM/聊天模型的字段:
| 字段 | 值 |
|---|---|
| 类型 | LLM |
| 模型名称 | Qwen/Qwen3-32B |
| API 密钥 | WEIGHTSAPI_API_KEY |
| API 基础 URL | https://weightsapi.com/v1 |
| 补全模式 | Chat |
| API 类型 | Chat Completions API (/chat/completions) |
| 模型上下文大小 | 实际部署上下文限制 |
| 最大 token 上限 | 实际部署输出限制 |
| 视觉支持 | 不支持(此模型仅支持文本) |
| 函数调用类型 | 不支持,直到原生工具经过验证 |
底层凭据的确切名称是 api_key、endpoint_url、mode: chat、api_type: chat_completions、context_size 和 max_tokens_to_sample。可选的 API 端点的模型名称(endpoint_model_name)可以覆盖发送的模型名称;如果模型名称已经匹配,请留空。对于此 LLM 方案,请使用包含 /v1 的基础 URL;此插件对非 LLM 类型有不同的路径处理,因此未经检查请勿将此方案扩展到 embeddings。
验证连接#
获取模型列表,然后发送一条简短消息。模型列表成功并不证明支持工具、视觉或 JSON schema。启用这些功能前请检查所选部署的能力。