weightsapi.INFERÊNCIAConsole
Navegação
REFERÊNCIA DO MODELO

Qwen3-Coder-Next

Um modelo de codificação somente texto para exploração de base de código e fluxos de trabalho com ferramentas, com um contexto nativo publicado de 262.144 tokens.

Sem KYC

Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.

Sem filtros de conteúdo adicionais

A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.

INPUT / 1M$0.12
OUTPUT / 1M$0.80
SERVICE CONTEXT*128K
VELOCIDADE MEDIDAnão medido

ID do modelo de APIQwen/Qwen3-Coder-Next

Contexto nativo262.144 tokens

QuantizaçãoNão verificado

LicençaApache 2.0

Melhor para#

Exploração de base de código, assistentes de codificação e fluxos de trabalho iterativos com ferramentas. A Qwen projetou este modelo para agentes de codificação e ferramentas de desenvolvimento. Use tarefas representativas do repositório para avaliá-lo. Cartão do modelo do editor.

Escolha outro modelo quando#

Sua tarefa requer entrada de imagem ou um modo de pensamento selecionável. Este checkpoint aceita texto e opera em modo sem pensamento. Recursos publicados.

Detalhes da implantação#

A configuração especifica 262.144 posições sem escalonamento RoPE. O serviço precisa de um runtime Qwen3-Next compatível e do parser de chamada de ferramentas de codificação. Confirme a janela de serviço, hardware e quantização de serviço do WeightsAPI para a implantação selecionada.

A inferência compartilhada é cobrada pelos preços de entrada e saída mostrados nesta página, em USD por milhão de tokens. As mesmas tarifas se aplicam em toda a janela de contexto do serviço WeightsAPI; nenhum desconto por cache ou processamento em lote se aplica a esta tarifa padrão. Confirme o contexto implantado antes de usar o teto de serviço listado de 131.072 tokens. Consulte preços e status do serviço antes do uso.

Licença e procedência#

O checkpoint oficial é publicado pela Qwen sob Apache-2.0. Mantenha seu identificador exato ao comparar resultados de implantação. Repositório oficial.

Chame este modelo#

Prepare uma solicitação de chat-completions com model definido como Qwen/Qwen3-Coder-Next. Siga o guia de início rápido, verifique a disponibilidade da implantação e valide o comportamento da ferramenta antes do uso.

Para acessar a IA, é necessário fazer login e já ter uma primeira recarga confirmada de pelo menos 100 USD. Depois, basta ter saldo disponível suficiente para cada solicitação. Os preços publicados não ativam um modelo: consulte o status do serviço para verificar a disponibilidade da implantação.

Exemplo de solicitação

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-Coder-Next",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'