weightsapi.INFERENZKonsole
Navigation
MODELLREFERENZ

Dolphin Mistral 24B Venice Edition

Konversationen und Charaktere mit anwendungsgesteuerten Anweisungen, von Dolphin und Venice.

Kein KYC

Kein Hochladen von Ausweisdokumenten oder KYC-Schritt im aktuellen Anmeldevorgang. Zugriff und Nutzung bleiben mit Ihrem Konto verknüpft.

Keine zusätzlichen Inhaltsfilter

WeightsAPI fügt am Gateway keinen Inhaltsfilter hinzu. Das eigene Training eines Modells kann dennoch dazu führen, dass es eine Anfrage ablehnt.

INPUT / 1M$0.20
OUTPUT / 1M$0.90
SERVICE CONTEXT*128K
GEMESSENE GESCHWINDIGKEITnicht gemessen

API-Modell-IDdphn/Dolphin-Mistral-24B-Venice-Edition

Veröffentlichter Kontext131.072 Token

QuantisierungNicht verifiziert

LizenzApache 2.0

Am besten für#

Charakterbasierte Konversationen und Assistenten, deren Ton und Anweisungen von der Anwendung gesteuert werden. Dolphin hat diese Edition mit Venice entwickelt, um die Benutzerkontrolle zu betonen.

Wählen Sie ein anderes Modell, wenn#

Sie Audio, Video oder unabhängig validiertes Bildverständnis benötigen. Die Autoren beschreiben dieses Modell als unzensiert; das garantiert nicht, dass jede Anfrage eine Antwort erhält.

Deployment-Details#

Die aktuelle Upstream-Version 1.2 umfasst Text- und Bildeingabe sowie einen konfigurierten Kontext von 131.072 Positionen. Bestätigen Sie das Serving-Limit und die Präzision von WeightsAPI für die Bereitstellung. Gemessener Durchsatz ist nicht verfügbar.

Die gemeinsame Inferenz wird zu den auf dieser Seite angegebenen Eingabe- und Ausgabepreisen in USD pro Million Token abgerechnet. Dieselben Sätze gelten für das gesamte Service-Kontextfenster von WeightsAPI; auf diesen Standardtarif wird kein Cache- oder Batch-Rabatt gewährt. Bestätigen Sie den bereitgestellten Kontext, bevor Sie die aufgeführte Service-Obergrenze von 131.072 Token nutzen. Siehe Preisgestaltung und Dienststatus vor der Nutzung.

Lizenz und Herkunft#

Dies sind von Dolphin veröffentlichte Gewichte, keine unveränderte Mistral-Veröffentlichung. Der Herausgeber erklärt Apache 2.0 in der Modellkarte. Das Update auf Version 1.2 dokumentiert die hinzugefügte Vision und den längeren Kontext.

Dieses Modell aufrufen#

Sobald ein bepreistes Deployment aktiviert ist, verwenden Sie dphn/Dolphin-Mistral-24B-Venice-Edition mit Chat Completions. WeightsAPI fügt keinen Gateway-Inhaltsfilter hinzu. Anwendungsanweisungen, Modellverhalten und die Serving-Konfiguration können dennoch Antworten beeinflussen, einschließlich Ablehnungen.

Für den KI-Zugriff müssen Sie angemeldet sein und bereits eine bestätigte Aufladung von mindestens 100 USD vorgenommen haben. Danach muss das verfügbare Guthaben für die jeweilige Anfrage ausreichen. Veröffentlichte Preise aktivieren kein Modell: Prüfen Sie den Dienststatus, um die Verfügbarkeit der Bereitstellung festzustellen.

Anfragebeispiel

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "dphn/Dolphin-Mistral-24B-Venice-Edition",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'