weightsapi.推論コンソール
ナビゲーション
KYC不要 · 追加コンテンツフィルターなし

マネージドLLM推論。オープンモデル、1つのAPI。

OpenAI互換APIを通じて公開されたオープンウェイトモデルを選択します。使い慣れたツールを維持し、トークンコストを比較し、ワークロードに合うモデルを選びましょう。

KYC不要

現在のサインインフローでは身分証明書のアップロードやKYC手続きはありません。アクセスと利用はアカウントに関連付けられます。

追加コンテンツフィルターなし

WeightsAPIはゲートウェイでコンテンツフィルターを追加しません。モデル自体のトレーニングにより、リクエストを拒否する場合があります。

最初のリクエストを形にする。

カタログからモデルを選び、短いプロンプトを書き、対応するコードを確認します。最初の例はシンプルに保ち、リクエストと期待される回答を簡単に確認できるようにしましょう。

アカウントアクセス サインインし、最低100米ドルのトップアップを確認してから、前払いクレジットを使用してください。すべてのチャージには同じ最低額が適用されます。残高が少なくても利用可能です。モデルの利用可能性はサービスステータスで確認してください。

プレイグラウンド資金のあるアカウントが必要です
128K コンテキスト*
アカウントアクセスを確認中…
プロンプトの内容はこのゲートウェイによって保存されません。
応答アカウント、キー、サービスのチェックが通ったら準備完了

最初のリクエスト前にアクセスを確認

サインインし、最低100米ドルのチャージを確認し、APIキーを選択して最初のリクエストを送信してください。
curl https://weightsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "Qwen/Qwen3-32B",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "stream": true,
  "max_tokens": 512
}'
同じリクエストを、あなたのアプリケーションで。クイックスタートを読む

* サービスコンテキスト。ネイティブウィンドウと構成要件についてはモデルページを参照してください。

アプリケーションを中心に構築する

有用なタスクから始める。

クックブックには、アプリケーションが制御を保ったまま適応できる小さな例があります。

会話アシスタント

会話ループを構築し、メッセージ履歴を管理し、ユーザーが受け取る回答を検証します。ユーザーインターフェースを追加する前にターミナルの例から始めます。

チャットボットレシピ

コーディングとツール

明示的な許可リストと引数チェックを備えたツール呼び出しループを調べます。アクションを有効にする前に、モデルとデプロイメントのサポートを検証する必要があります。

ツール呼び出しレシピ

ドキュメントからの回答

独自のリトリーバーを持ち込み、選択したパッセージを提供し、引用を検証します。例では単純なテキストマッチングを使用します。埋め込みサービスは利用できません。

ドキュメントレシピ
ユースケース
実践的な出発点

最初のワークフローを計画する。

トラフィックを増やしたり機能を追加したりする前に、アプリケーションに必要なものを決めます。

  1. タスクに合わせて選ぶ

    機能、モデルライセンス、コンテキスト、入出力レートを比較してください。モデルにリクエストをルーティングする前に、サービスステータスと確認済みのデプロイメント制限を確認してください。

    モデルを比較する
  2. 小さなリクエストを準備する

    正確なモデルIDと制限された出力でチャット補完形式を使用します。再試行やツールを追加する前に、ストリーミングガイドとエラーガイドを読んでください。

    クイックスタートを開く
  3. 使用状況を理解可能に保つ

    個別のキーと支出上限でアプリケーションを分離します。コンソールは、保留中のリクエストのために予約された金額を含め、使用状況と利用可能クレジットを確認する場所です。

    コンソールを調べる
仕組み
モデルカタログ

適切なトレードオフを選ぶ。

以下に公開されている選択肢を比較し、モデルページを開いて機能、ライセンス、デプロイメントノートを確認します。価格だけでは品質や速度は決まりません。

モデル入力出力サービスコンテキスト
LLlama 3.1 8B$0.03$0.05131,072
QQwen3 32B$0.15$0.20131,072
DDeepSeek V3$0.25$0.85131,072
DDeepSeek R1$0.50$2.15131,072

入出力レートは100万トークンあたりの米ドルです。サービスコンテキストの制限にはデプロイメントの確認が必要です。モデルネイティブの制限とは別です。

既存のツール

既存のツールを活用する

使い慣れたツールを文書化された設定で接続してください。トラフィックを移行する前に、選択したデプロイメントでアプリケーションが必要とする機能を検証してください。

すべての統合を見る
境界を知る

サービス境界を理解する

モデルを選択する前に、アカウント管理、データ処理、デプロイメント要件を確認してください。

定義されたデータ境界

ゲートウェイはプロンプトやレスポンスを永続化しません。プロバイダーの保持とインフラストラクチャのログ記録は依然として検証が必要です。これはエンドツーエンドの保持保証ではありません。

信頼の概要を読む
概要
始める前に

始める前の質問。

アプリケーションに組み込む前に、可用性、互換性、コスト、データ処理を理解します。

KYCを完了する必要がありますか?

現在のサインインフローでは身分証明書のアップロードやKYC確認手続きはありません。サインイン済みのアカウントは必要で、利用はそのアカウントに関連付けられます。

続きを読む

モデルは無検閲ですか?

WeightsAPIはゲートウェイでコンテンツフィルターを追加しません。カタログには、DolphinやHermesを含む、それぞれの作成者によって公開されたオリジナルモデルとファインチューニングされたバリアントが含まれています。一部のバリアントは拒否を減らすように設計されていますが、モデルのトレーニングによって拒否が発生する可能性があります。各モデルのソースと動作に関する注意事項をお読みください。

続きを読む

今日は何が使えますか?

APIキーの管理、暗号資産による入金注文の作成、専用GPU注文の実行が可能です。モデルの可用性はサービスステータスで確認してください。支払いクレジットとGPUの有効化には確認が必要です。

続きを読む

OpenAI互換とはここではどういう意味ですか?

APIはChat Completions、レガシーCompletions、モデル検出ルートを使用します。選択したデプロイメントの機能を確認してください。プロバイダー固有のAPIは互換性がありません。

続きを読む

モデルリクエストの料金はどう計算されますか?

コストは実際の入力トークンと出力トークンに対してモデルごとの個別のレートを使用し、初期のクレジット予約後にプロバイダー確認済みの使用量から決済されます。

続きを読む

WeightsAPIはプロンプトやモデル応答を保存しますか?

ゲートウェイはプロンプトや応答をアプリケーションデータベースに永続化しません。アカウント記録は残り、プロバイダーの保持については個別の検証が必要です。

続きを読む
完全なFAQを読む

モデルを選ぶ。最初のリクエストを明確に。

カタログと小さな例から始めます。ドキュメントはリクエスト形式を説明し、FAQはその周りの決定の解決に役立ちます。