weightsapi.INFERÊNCIAConsole
Navegação
REFERÊNCIA DO MODELO

Hermes 4 70B

Conversa criativa, roleplay e raciocínio com instruções configuráveis, publicado pela Nous Research.

Sem KYC

Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.

Sem filtros de conteúdo adicionais

A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.

INPUT / 1M$0.13
OUTPUT / 1M$0.40
SERVICE CONTEXT*128K
VELOCIDADE MEDIDAnão medido

ID do modelo de APINousResearch/Hermes-4-70B

Contexto publicado131.072 tokens

QuantizaçãoNão verificado

LicençaMeta Llama Community

Melhor para#

Escrita criativa, roleplay e assistentes que combinam conversa com raciocínio ou saídas estruturadas. A Nous Research enfatiza comportamento configurável e redução de recusas.

Escolha outro modelo quando#

Você precisa de entrada de imagem ou áudio, ou de um modelo menor para orçamentos de hardware mais restritos. O Hermes 4 70B é apenas texto, e seu posicionamento publicado não garante respostas sem recusas.

Detalhes da implantação#

A configuração publicada suporta 131.072 posições e os pesos originais usam BF16. Confirme o contexto e a precisão de serviço do WeightsAPI para a implantação. Não há medições de velocidade de processamento disponíveis. Valide o raciocínio e as chamadas de ferramentas antes de ativá-los.

A inferência compartilhada é cobrada pelos preços de entrada e saída mostrados nesta página, em USD por milhão de tokens. As mesmas tarifas se aplicam em toda a janela de contexto do serviço WeightsAPI; nenhum desconto por cache ou processamento em lote se aplica a esta tarifa padrão. Confirme o contexto implantado antes de usar o teto de serviço listado de 131.072 tokens. Consulte preços e status do serviço antes do uso.

Licença e procedência#

A Nous publica esses pesos como um derivado do Llama 3.1 70B. O cartão do modelo rotula sua licença como llama3; o repositório não possui um arquivo de licença autônomo que esclareça esse rótulo. Revise os termos subjacentes do Llama 3.1, incluindo atribuição e condições de uso.

Chame este modelo#

Uma vez que uma implantação com preço esteja habilitada, use NousResearch/Hermes-4-70B com Chat Completions. O WeightsAPI não adiciona filtro de conteúdo de gateway. Recusas ainda podem ocorrer, e o modelo de chat publicado e os recursos suportados devem corresponder à configuração de serviço.

Para acessar a IA, é necessário fazer login e já ter uma primeira recarga confirmada de pelo menos 100 USD. Depois, basta ter saldo disponível suficiente para cada solicitação. Os preços publicados não ativam um modelo: consulte o status do serviço para verificar a disponibilidade da implantação.

Exemplo de solicitação

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "NousResearch/Hermes-4-70B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'