weightsapi.INFERÊNCIAConsole
Navegação
REFERÊNCIA DO MODELO

Dolphin Mistral 24B Venice Edition

Conversas e personagens com instruções controladas pelo aplicativo, da Dolphin e da Venice.

Sem KYC

Nenhum upload de documento de identidade ou etapa de KYC no fluxo de login atual. O acesso e o uso permanecem vinculados à sua conta.

Sem filtros de conteúdo adicionais

A WeightsAPI não adiciona nenhum filtro de conteúdo no gateway. O próprio treinamento de um modelo ainda pode levá-lo a recusar uma solicitação.

INPUT / 1M$0.20
OUTPUT / 1M$0.90
SERVICE CONTEXT*128K
VELOCIDADE MEDIDAnão medido

ID do modelo de APIdphn/Dolphin-Mistral-24B-Venice-Edition

Contexto publicado131.072 tokens

QuantizaçãoNão verificado

LicençaApache 2.0

Melhor para#

Conversas baseadas em personagens e assistentes cujo tom e instruções são controlados pelo aplicativo. A Dolphin desenvolveu esta edição com a Venice para enfatizar o controle do usuário.

Escolha outro modelo quando#

Você precisa de áudio, vídeo ou compreensão de imagem validada de forma independente. Os autores descrevem este modelo como não censurado; isso não garante que todas as solicitações receberão uma resposta.

Detalhes da implantação#

A versão upstream atual 1.2 inclui entrada de texto e imagem e um contexto configurado de 131.072 posições. Confirme o limite e a precisão de serviço do WeightsAPI para a implantação. Não há medições de velocidade de processamento disponíveis.

A inferência compartilhada é cobrada pelos preços de entrada e saída mostrados nesta página, em USD por milhão de tokens. As mesmas tarifas se aplicam em toda a janela de contexto do serviço WeightsAPI; nenhum desconto por cache ou processamento em lote se aplica a esta tarifa padrão. Confirme o contexto implantado antes de usar o teto de serviço listado de 131.072 tokens. Consulte preços e status do serviço antes do uso.

Licença e procedência#

Estes são pesos publicados pela Dolphin, não uma versão inalterada da Mistral. O editor declara Apache 2.0 no cartão do modelo. A atualização da versão 1.2 documenta a visão adicionada e o contexto mais longo.

Chame este modelo#

Uma vez que uma implantação com preço esteja habilitada, use dphn/Dolphin-Mistral-24B-Venice-Edition com Chat Completions. O WeightsAPI não adiciona filtro de conteúdo de gateway. As instruções do aplicativo, o comportamento do modelo e a configuração de serviço ainda podem afetar as respostas, incluindo recusas.

Para acessar a IA, é necessário fazer login e já ter uma primeira recarga confirmada de pelo menos 100 USD. Depois, basta ter saldo disponível suficiente para cada solicitação. Os preços publicados não ativam um modelo: consulte o status do serviço para verificar a disponibilidade da implantação.

Exemplo de solicitação

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "dphn/Dolphin-Mistral-24B-Venice-Edition",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'