weightsapi.推論コンソール
ナビゲーション
モデルリファレンス

Dolphin Mistral 24B Venice Edition

DolphinとVeniceによる、アプリケーション制御の指示を持つ会話とキャラクター。

KYC不要

現在のサインインフローでは身分証明書のアップロードやKYC手続きはありません。アクセスと利用はアカウントに関連付けられます。

追加コンテンツフィルターなし

WeightsAPIはゲートウェイでコンテンツフィルターを追加しません。モデル自体のトレーニングにより、リクエストを拒否する場合があります。

INPUT / 1M$0.20
OUTPUT / 1M$0.90
SERVICE CONTEXT*128K
測定された速度未測定

APIモデルIDdphn/Dolphin-Mistral-24B-Venice-Edition

公開されたコンテキスト131,072 トークン

量子化未検証

ライセンスApache 2.0

最適な用途#

キャラクターベースの会話や、アプリケーションがトーンと指示を制御するアシスタント。Dolphinはユーザー制御を重視してVeniceと共同でこのエディションを開発しました。

別のモデルを選ぶべき場合#

音声、動画、または独立して検証された画像理解が必要な場合。作者はこのモデルを無検閲と説明していますが、すべてのリクエストに回答が得られる保証はありません。

デプロイメント詳細#

モデル開発元の現在のバージョン1.2は、テキストと画像の入力に対応し、131,072のコンテキスト位置が設定されています。WeightsAPIの実際のデプロイメントのサービス上限と数値精度を確認してください。スループットの実測データはありません。

共有推論は、このページに記載された入力トークンと出力トークンの料金で課金されます。単位は100万トークンあたりの米ドルです。WeightsAPIのサービス用コンテキストウィンドウ全体に同じ料金が適用され、この標準料金にキャッシュやバッチ処理の割引はありません。記載された131,072トークンのサービス上限を利用する前に、実際のデプロイメントのコンテキスト上限を確認してください。利用前に料金サービス状況をご確認ください。

ライセンスと出所#

これらはDolphinによって公開された重みであり、Mistralの変更されていないリリースではありません。出版社はモデルカードでApache 2.0を宣言しています。バージョン1.2のアップデートは追加されたビジョンとより長いコンテキストを文書化しています。

このモデルを呼び出す#

価格設定されたデプロイメントが有効になったら、Chat Completionsでdphn/Dolphin-Mistral-24B-Venice-Editionを使用してください。WeightsAPIはゲートウェイコンテンツフィルターを追加しません。アプリケーションの指示、モデルの動作、サービング設定は、拒否を含む応答に影響を与える可能性があります。

AIの利用には、サインイン、少なくとも100米ドルのチャージ1回の入金確認、および十分な利用可能残高が必要です。この条件を満たす初回チャージ後は、残高が100米ドルを下回っても、リクエストの料金を支払える限り引き続き利用できます。料金が公開されていても、モデルが有効になっているとは限りません。サービス状況でデプロイメントの利用可否を確認してください。

リクエスト例

curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "dphn/Dolphin-Mistral-24B-Venice-Edition",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true
}'