weightsapi.推理控制台
导航
模型参考

DeepSeek V4 Flash

一种用于长上下文推理、编码和工具工作流的文本模型,配置了 1,048,576 个令牌的窗口。

无需 KYC

当前登录流程中无需上传身份证明文件或进行 KYC 步骤。访问和使用与您的账户关联。

无附加内容过滤

WeightsAPI 在网关处不添加任何内容过滤器。模型自身的训练仍可能导致其拒绝请求。

INPUT / 1M$0.09
OUTPUT / 1M$0.18
SERVICE CONTEXT*128K
实测速度未测量

API 模型 IDdeepseek-ai/DeepSeek-V4-Flash

已发布的上下文1,048,576 令牌

量化未验证

许可证MIT

最适合#

长文本分析、编码和工具工作流,值得评估不同的推理预算。DeepSeek 将此检查点作为早期版本发布,具有非思考和推理模式。请在模型卡中查看发布者的发布状态和能力。

在以下情况选择其他模型#

您的应用需要图像输入,或使用的服务栈不支持 DeepSeek-V4。这是一个使用专用对话编码格式的文本模型。编码参考

部署详情#

配置使用 YaRN 缩放支持 1,048,576 个位置。服务必须处理其编码、混合精度权重和输出解析。发布者规格与 WeightsAPI 的可用性是分开的。确认所选部署的服务上下文、服务精度和支持的模式。

共享推理按本页面所示的输入和输出价格计费,单位为每百万个令牌的美元金额。同等的费率适用于 WeightsAPI 服务的整个上下文窗口;此标准费率不享受任何缓存或批量折扣。在使用列出的 131,072 个令牌的服务上限之前,请确认部署的上下文。使用前请参阅定价服务状态

许可与来源#

确切的官方检查点是 deepseek-ai/DeepSeek-V4-Flash。其仓库和权重根据 MIT 许可证发布。

调用此模型#

使用快速入门准备 model: "deepseek-ai/DeepSeek-V4-Flash"。在可用的部署上,使用短输入验证推理模式设置和工具解析,然后再使用长上下文。

访问 AI 需要登录、账户已收到一笔至少 100 美元的已确认充值,并有足够的可用余额。在首次符合条件的充值后,即使剩余余额低于 100 美元,只要足以支付请求,仍可继续使用。公布价格并不代表模型已经启用;请查看服务状态以确认部署是否可用。

请求示例

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-ai/DeepSeek-V4-Flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'