weightsapi.推理控制台
导航
模型目录

模型目录

在能力、上下文和成本之间选择合适的平衡。

无需 KYC

当前登录流程中无需上传身份证明文件或进行 KYC 步骤。访问和使用与您的账户关联。

无附加内容过滤

WeightsAPI 在网关处不添加任何内容过滤器。模型自身的训练仍可能导致其拒绝请求。

15 个开放权重模型,均为其开发者发布的版本。

已发布的模型来源已验证 2026-09-04. Check service status for current availability. API 模型列表 ↗

模型输入 / 每百万输出 / 每百万上下文类型
LLlama 3.1 8B$0.03$0.05128K*文本
DDeepSeek V4 Flash$0.09$0.18128K*文本
GGemma 3 27B$0.10$0.15128K*文本 + 图像
MMistral Small 3$0.10$0.2032K*文本
QQwen3-Coder-Next$0.12$0.80128K*文本
HHermes 4 70B$0.13$0.40128K*文本
MMistral Small 4$0.15$0.60128K*文本 + 图像
QQwen3 32B$0.15$0.20128K*文本
DDolphin Mistral 24B Venice Edition$0.20$0.90128K*文本 + 图像
QQwen3 235B A22B$0.20$0.60128K*文本
DDeepSeek V3$0.25$0.85128K*文本
LLlama 3.3 70B$0.35$0.40128K*文本
DDeepSeek R1$0.50$2.15128K*文本
MMixtral 8×22B$0.60$0.6064K*文本
LLlama 3.1 405B$1.20$1.20128K*文本

按工作负载选择

Llama 3.1 8B

快速分类、提取和轻量聊天。

$0.03 / $0.05Llama 3.1 Community

DeepSeek V4 Flash

一种用于长上下文推理、编码和工具工作流的文本模型,配置了 1,048,576 个令牌的窗口。

$0.09 / $0.18MIT

Gemma 3 27B

图像理解和多语言对话。

$0.10 / $0.15Gemma Terms of Use

Mistral Small 3

高效文本任务、函数调用和欧洲语言聊天。

$0.10 / $0.20Apache 2.0

Qwen3-Coder-Next

用于代码库探索和工具工作流的纯文本编程模型,公开的原生上下文为 262,144 个标记。

$0.12 / $0.80Apache 2.0

Hermes 4 70B

由 Nous Research 发布的创意对话、角色扮演和推理,指令可配置。

$0.13 / $0.40Meta Llama Community

Mistral Small 4

结合文本和图像输入、工具调用和可配置推理的官方 Mistral 模型,公开的窗口为 262,144 个标记。

$0.15 / $0.60Apache 2.0

Qwen3 32B

代码、多语言聊天和推理的均衡选择。

$0.15 / $0.20Apache 2.0

Dolphin Mistral 24B Venice Edition

来自 Dolphin 和 Venice 的对话与角色,指令由应用控制。

$0.20 / $0.90Apache 2.0

Qwen3 235B A22B

强通用指令遵循和工具使用。

$0.20 / $0.60Apache 2.0

DeepSeek V3

代码生成、复杂指令和结构化任务。

$0.25 / $0.85MIT

Llama 3.3 70B

通用助手、摘要和工具使用。

$0.35 / $0.40Llama 3.3 Community

DeepSeek R1

困难推理、数学和代码分析。

$0.50 / $2.15MIT

Mixtral 8×22B

多语言生成和函数调用工作流。

$0.60 / $0.60Apache 2.0

Llama 3.1 405B

要求高的通用生成和复杂指令。

$1.20 / $1.20Llama 3.1 Community