weightsapi.推理控制台
导航
常见问题解答

常见问题

关于 WeightsAPI 访问、API 集成、加密货币余额、计费和数据处理的实际答案。

概览

关于访问、模型、成本、数据和服务可用性的明确解答。

入门

了解当前可用的功能,并准备你的第一次集成。

我今天可以使用什么?{#available-now}

管理 API 密钥、创建加密货币充值订单和放置专用 GPU 订单。检查服务状态以了解模型可用性;支付余额和 GPU 激活需要确认。

浏览模型目录和文档,登录控制台,并创建或撤销 API 密钥。加密货币结算提供金额、网络、地址和付款截止时间;余额需要经过验证的交易。专用订单可以从已确认的余额中下单并支付,硬件在配置后激活。在发送模型请求前,请检查状态快速入门

在使用 AI 前,请登录并确认一笔至少 100 美元的充值。之后的每次充值都有相同的最低金额;在符合资格后,如果剩余余额足够支付请求,则仍可使用较小的余额。密钥权限、支出上限和模型可用性仍然适用。待处理的付款不会解锁访问权限。在发送请求前,请检查服务状态

我需要完成 KYC 吗?

当前登录流程中没有上传身份证明文件或进行 KYC 验证的步骤。但仍需要登录账户,使用情况会与该账户关联。

我如何创建账户和 API 密钥?{#create-account}

登录控制台,创建一个带有支出和模型控制功能的密钥,并立即复制其秘密,因为它只显示一次。

登录控制台并创建一个命名密钥,设置正支出上限,如有需要,还可设置允许的模型列表。当秘密出现时立即复制:控制台仅在创建时显示它。将其保存在服务器端环境变量或秘密管理器中。密钥控制访问权限;还需要可用余额和可用模型。请参阅身份验证

为了让我的第一个请求成功,我需要什么?{#first-request}

使用可用的模型、已授权的密钥和足够的已确认余额。选择准确的模型 ID,并将输出保持在该部署的限制范围内。

使用快速入门中的基础 URL,将 API 密钥作为 Bearer 令牌发送,并选择 /v1/models 返回的准确模型 ID。设置适合您的预算和部署上下文窗口的输出令牌限制。在提交请求前,请检查服务状态

AI 访问需要登录、一笔至少 100 美元的已确认充值、已授权的 API 密钥以及足够的可用余额来支付请求。之后的每次充值也有 100 美元的最低金额;较小的剩余余额在足以支付请求时仍可使用。余额需要交易验证。在发送流量前,请检查服务状态以了解模型可用性。

我可以重用现有的 OpenAI 或 Anthropic 集成吗?

OpenAI Chat Completions 需要新的基础 URL、密钥和模型;Anthropic 还需要更改 SDK、消息格式和响应解析。

对于 OpenAI Chat Completions 集成,主要更改是基础 URL、API 密钥和模型 ID。特定提供商的 API 和功能需要单独检查。Anthropic 集成还需要对 SDK、消息格式、系统提示位置和响应解析进行更改。请遵循 迁移指南,然后在移动流量之前,对已连接的部署测试代表性提示、工具和结构化输出。熟悉请求格式的兼容性并不能保证模型行为完全相同。

我应该如何选择模型?{#choose-model}

在您自己的任务上评估最小的合适模型,然后验证其可用性、上下文限制以及所需的工具或模式支持。

从任务开始:短交互式聊天、编程、推理或更长的文档输入。比较模型页面上的发布者规范、服务上下文和输入/输出速率。检查模型可用性,并在您自己的任务上评估最小的合适候选模型。在将应用绑定到某个模型之前,请单独验证工具调用或模式支持。

模型和 API 功能

检查兼容性范围以及每项功能的要求。

模型是否不受审查?

WeightsAPI 在网关不添加内容过滤器。目录包括原始模型和由各自创作者发布的微调变体,包括 Dolphin 和 Hermes。一些变体旨在减少拒绝;模型训练仍可能导致拒绝。请阅读每个模型的来源和行为说明。

“OpenAI 兼容”在此处是什么意思?{#api-compatibility}

API 使用 Chat Completions、旧版 Completions 和模型发现路由。请检查所选部署的能力;提供商特定的 API 不可互换。

WeightsAPI 接受 Chat Completions、旧版 Completions 和模型发现请求格式。生成需要一个支持所选操作的可用部署。响应、助手和提供商特定的工具不能直接替换。请查阅API 参考了解支持的操作,然后在切换流量前验证应用使用的功能。

API 支持流式响应吗?{#streaming}

在可用的部署上使用服务器发送事件进行流式聊天响应,并保留最终的使用记录用于计费。

为可用的聊天部署设置 stream: true,并消费完整的服务器发送事件。一个网络数据块不一定是一条消息,最终的使用记录可能会在答案文本结束后才到达。将流转发到浏览器时,请将 API 密钥保留在服务器上。流式指南涵盖了使用情况和中断连接;请检查服务状态以了解可用性。

模型可以为我的应用程序调用工具或运行操作吗?{#tool-calling}

您的应用程序验证并执行工具调用。所选模型和部署必须支持工具格式,然后才能启用操作。

网关将工具定义转发给所选模型。模型可以返回请求的工具名称和参数;由您的应用程序决定是否执行该操作。请根据允许列表和当前用户的权限验证两者,然后在对话中返回结果。WeightsAPI 不会执行您应用程序的工具。在启用操作前,请检查部署支持情况并遵循函数调用

我可以要求响应符合 JSON 模式吗?{#structured-output}

严格 JSON 需要一个具有兼容约束解码的部署。请根据您的模式验证每个响应,并处理无效或不完整的输出。

严格模式输出需要在所选部署中支持约束解码和您的模式。仅要求模型“返回 JSON”并不能保证模式匹配。网关转发 response_format;在依赖它之前,请确认部署的严格模式支持。遵循结构化输出指南,使用相同的模式验证每个结果,并明确处理截断或拒绝。

加密货币充值

在发送资金之前,请阅读确切的资产、网络和付款状态。

我可以使用哪些加密货币和网络?{#supported-assets}

使用当前支付配置中显示的资产和网络选项;显示的接收地址并不代表已确认的余额。

选择结账时显示的确切资产和网络,并使用与您的订单一起保存的接收地址。另一网络上的代币不可互换。即使支付配置发生变化,订单仍保留其资产、网络和地址。只有在传入交易被匹配并验证后,余额才会出现。请参阅计费

我如何添加加密货币余额?{#deposit-process}

结账会根据您的美元充值金额计算加密货币金额,并显示固定的接收地址、网络、汇率和付款截止时间。

创建一个至少 100 美元的充值订单。服务器获取最近的市场汇率,并将发送金额固定 10 分钟,包括 USDT 和 USDC。请保留订单参考号,并单独支付网络费用。交易匹配和余额确认是分开的已验证步骤;创建订单或刷新其状态不会添加余额。请参阅计费指南

为什么存款可能仍然处于待处理状态?{#pending-deposit}

订单会保持待处理状态,直到其转账被匹配、验证并计入余额。开始付款或刷新其状态并不会确认它。

订单以等待确认状态开始。其转账必须被匹配并验证,然后才会记录账户余额。付款声明或状态刷新不能将其标记为已支付。请保留订单参考号和公开交易标识符,不要仅仅因为第一笔付款待处理就再次发送付款。支持指南列出了需要保留的详细信息;确认和解决时间不作保证。

如果我发送了错误的资产或使用了错误的网络,会发生什么?

针对错误资产或错误网络转账的恢复和退款政策尚未建立;请使用充值订单中记录的确切目的地。

针对错误网络或错误资产转账的恢复政策尚未建立。不要假设转账可以被记入、恢复或退款。在转账之前,请根据当前充值说明核对资产、网络、地址和金额。如果发生转账问题,请通过 支持 提供订单引用和公开交易标识符;切勿分享钱包助记词或私钥。

加密货币金额如何计算?何时过期?

美元目标金额按最新市场汇率转换。加密货币金额向上取整到资产的最小单位,并固定10分钟。

结账页面显示汇率来源、汇率时间戳和支付截止时间。USDT和USDC使用其实际市场汇率,而非假设的1美元平价。如果无法获取最新汇率,请在发送资金前重试计算。已有订单即使没有报价,也可以获取一个,订单号和地址不会改变。

报价过期后,仅当您尚未发送资金时,才获取新报价。如果已经发送转账,请保留原订单;确认信息可能会稍后到达。在报价窗口内收到精确金额的付款,经验证后可按报价的美元金额入账。逾期转账或金额不符需要审核;待处理付款不会解锁AI访问。请参阅计费

计费和 API 密钥

了解使用费用、预留信用以及每个密钥的控制措施。

模型请求如何定价?{#token-pricing}

成本使用针对实际输入和输出令牌的单独模型费率,在初始余额预留后根据提供商确认的使用量进行结算。

共享推理对每个模型有单独的输入和输出费率。被接受的请求会预留足够的余额来覆盖已计数的输入和最大请求输出,然后根据该预留保存的费率对权威使用量进行结算。使用定价表来估算您的工作负载。没有已发布价格的模型无法接受付费请求。在推理分发前被拒绝的请求不会产生令牌费用。请参阅计费

为什么我的可用信用可能低于余额?

可用信用是账本余额减去未结推理预留;这些预留会一直被持有,直到权威用量可以结算。

余额来自账户账本;可用信用还会减去未结推理预留。预留会持有允许的请求成本上限,这样并发请求就不会花费同一笔信用。当权威用量到达时,最终费用会取代该预留。如果流中断或提供商用量缺失,该预留可能会保持待对账状态。客户端断开连接不能证明生成已停止。请查阅 流式传输计费,并通过 支持 报告未解决的预留。

支出上限和模型限制保护什么?{#key-controls}

支出上限涵盖每个密钥的终身使用量和未结预留,而模型允许列表限制其允许的模型;上限不会每月重置。

每个密钥都有一个终身美元支出上限,包括已记录的使用量和未结预留。它不会每月重置。模型允许列表限制密钥可以使用的确切模型 ID;空列表允许所有可用的目录模型。使用单独的密钥来区分使用记录中的应用程序和环境。密钥控制不会增加账户余额或改变模型可用性。请参阅身份验证

如果我丢失或泄露了 API 密钥,该怎么办?

立即撤销已泄露的密钥,创建替代密钥并更新你的应用;现有机密无法再次显示。

控制台无法再次显示现有机密。请创建替代密钥,安全存储,更新使用它的应用,并撤销旧密钥。如果密钥已泄露,请立即撤销并检查账户的用量记录。撤销会阻止使用该密钥的新请求被接受;已经接受的工作仍可结算。切勿将 API 密钥粘贴到支持消息、公共仓库或浏览器包中。请遵循 身份验证指南

我可以提取未使用的余额或获得自动退款吗?{#withdrawals}

钱包提取目前不可用。已确认的余额可以支付服务使用费用;在激活前取消 GPU 订单会将其付款退回您的账户余额。

钱包提取目前不可用。使用已确认的预付余额来支付符合条件的模型请求或专用 GPU 订单。在激活前取消已支付的 GPU 订单会将租金付款退回您的 WeightsAPI 账户余额;它不会将加密货币发送到钱包。不承诺自动退款或钱包支付。在添加余额之前,请查看计费

数据与隐私

将提示处理与运营账户所需的记录分开。

WeightsAPI 是否存储我的提示或模型响应?{#content-logging}

网关不会在其应用数据库中持久存储提示或响应。账户记录仍会保留,提供商保留情况需要单独验证。

网关不会在其应用数据库中持久存储提示、完成文本或工具参数,应用日志也会省略请求主体。身份验证、使用和支付记录是分开存储的。提供商保留和基础设施日志需要独立验证;网关行为并非端到端的零保留保证。请阅读数据处理信任页面了解范围。

如果不记录提示内容,会保留哪些记录?

账户标识符、密钥哈希、付款记录、令牌数量、费用和预留元数据会被保留,用于身份验证和会计核算,而不会存储对话文本。

账户系统保留标识符、API 密钥哈希和元数据、充值和提取记录、令牌数量、费用和用量汇总。请求预留还会记录模型、适用费率和结算状态,以便对账。这些记录支持身份验证、支出控制和会计核算,而不会存储对话文本。因此,“不记录内容”并不意味着匿名使用或没有保留记录。请查阅 数据处理;保留期限和生产数据权利流程仍需要发布并经过验证的条款。

专用 GPU 订单保留所选硬件和模型、月度价格、付款和取消状态,以及部署确认后的服务日期和端点详情。

隐私声明是否也涵盖推理提供商?{#upstream-retention}

否:网关的内容政策并不确立推理提供商的保留或训练实践,这些仍需验证。

网关的行为并不确立另一提供商的保留或训练政策。提供请求需要与推理提供商共享其内容。提供商的日志、子处理者和合同条款需要单独验证。如果您的工作负载有保密性或监管要求,请在发送敏感内容前查看信任页面并确认相关安排。

请求将在哪里处理,我可以选择区域吗?{#processing-regions}

达拉斯、阿什本和波特兰是计划中的地点,但没有经过验证的机群可用性、客户选择的区域或生产数据驻留承诺。

达拉斯、阿什本和波特兰是目标 GPU 地点。可用性、路由和数据驻留需要根据实际部署进行确认;仅凭地点名称并不能确立这些条件。区域选择和端到端驻留承诺必须针对部署达成一致。在承诺具有区域要求的工作负载之前,请查看数据处理信任页面

在使用 AI 之前需要确认充值吗?{#trial-privacy}

每次 AI 交互都需要一笔符合条件的已确认充值;最低金额为每次充值 100 美元,而不是永久的最低余额。

是的。在进行任何 AI 交互之前,您的账户必须收到一笔至少 100 美元的已确认充值;没有公开的免费试用额度。之后的每次充值也从 100 美元起。在初始符合条件的充值后,低于 100 美元的剩余余额仍然可以支付请求,直到不足为止。请使用具有所需模型权限和预算的活跃密钥。结账提供付款说明和限时的加密货币报价。余额需要一笔匹配且已验证的交易;创建或刷新订单并不会确认付款。

性能与支持

仔细规划容量,并在出现故障时收集有用的详细信息。

我可以期待什么样的延迟或吞吐量?{#performance-expectations}

性能取决于模型、硬件、工作负载、服务配置和并发性。请使用您自己的工作负载进行验证;不提供延迟或吞吐量保证。

性能取决于模型、硬件、提示长度、生成长度、并发性和服务配置。在可用的部署上,使用代表性工作负载分别测量首令牌时间和生成速度。已发布的模型特性和硬件规格并非 SLA。对于需要保留资源的工作负载,请查看专用容量;对于可用性,请查看服务状态

如果我有足够的信用,请求是否无限?

信用不会使使用量无限:容量、上下文、输出限制、模型权限和密钥支出上限仍然会约束请求。

不是。当前设计不会对付费流量施加默认的每分钟固定请求产品限制,但准入仍取决于可用信用、密钥上限、允许的模型、输出限制、上下文大小和后端容量。共享服务可能会排队,并且游乐场遵循与 API 请求相同的已确认充值、可用信用和密钥预算规则。模型的本地上下文窗口也可能超过配置的服务上限。请查看 限制 并使用有界重试处理 错误;不要将信用视为容量保证。

我现在可以订购专用 GPU 端点吗?{#dedicated-capacity}

可以。选择 GPU、选择模型并下月度订单。付款从已确认的账户余额中扣除;硬件在部署完成并获确认后可用。

使用专用 GPU 页面选择配置并打开结账。如果余额不足,请使用加密货币充值,并在余额确认后返回支付订单。充值不会自动支付租金。预付月份从激活时开始,不自动续订。在激活前取消会将任何租金付款退回您的账户余额。硬件可用性和交付时间需要运营商确认;订单并非已激活的机器。

我应该如何理解状态页面和 503 错误?{#service-status}

503 表示所需服务不可用。在重试前检查服务状态和错误消息;连接设置并不能确立正常运行时间。

503 service_unavailable 表示所需的部署或辅助服务无法接受请求。在使用有界重试之前,请检查状态页面错误指南。仅凭连接设置并不能证明服务健康或已测量的正常运行时间。在推理分发前被拒绝的请求不会产生令牌费用。

在寻求帮助时我应该包含哪些信息?{#contact-support}

请包含操作、时间和时区、模型、错误代码和相关参考;移除 API 密钥、钱包秘密和不必要的提示内容。

使用支持页面准备受影响的操作、大致时间和时区、模型 ID、错误代码和预期结果。对于计费或存款,请添加请求或订单参考号以及适用的公开交易标识符。移除 API 密钥、钱包秘密和不必要的提示内容。复制报告并不会提交它。官方支持联系方式、服务时间和响应目标未公布。

需要下一步吗?

查找相关指南或准备好您的问题详情。

打开支持