KYC不要
現在のサインインフローでは身分証明書のアップロードやKYC手続きはありません。アクセスと利用はアカウントに関連付けられます。
OpenAI互換APIを通じて公開されたオープンウェイトモデルを選択します。使い慣れたツールを維持し、トークンコストを比較し、ワークロードに合うモデルを選びましょう。
現在のサインインフローでは身分証明書のアップロードやKYC手続きはありません。アクセスと利用はアカウントに関連付けられます。
WeightsAPIはゲートウェイでコンテンツフィルターを追加しません。モデル自体のトレーニングにより、リクエストを拒否する場合があります。
カタログからモデルを選び、短いプロンプトを書き、対応するコードを確認します。最初の例はシンプルに保ち、リクエストと期待される回答を簡単に確認できるようにしましょう。
アカウントアクセス サインインし、最低100米ドルのトップアップを確認してから、前払いクレジットを使用してください。すべてのチャージには同じ最低額が適用されます。残高が少なくても利用可能です。モデルの利用可能性はサービスステータスで確認してください。
最初のリクエスト前にアクセスを確認
サインインし、最低100米ドルのチャージを確認し、APIキーを選択して最初のリクエストを送信してください。curl https://weightsapi.com/v1/chat/completions \
-H "Authorization: Bearer $WEIGHTSAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen/Qwen3-32B",
"messages": [
{
"role": "user",
"content": "Hello!"
}
],
"stream": true,
"max_tokens": 512
}'* サービスコンテキスト。ネイティブウィンドウと構成要件についてはモデルページを参照してください。
クックブックには、アプリケーションが制御を保ったまま適応できる小さな例があります。
会話ループを構築し、メッセージ履歴を管理し、ユーザーが受け取る回答を検証します。ユーザーインターフェースを追加する前にターミナルの例から始めます。
明示的な許可リストと引数チェックを備えたツール呼び出しループを調べます。アクションを有効にする前に、モデルとデプロイメントのサポートを検証する必要があります。
独自のリトリーバーを持ち込み、選択したパッセージを提供し、引用を検証します。例では単純なテキストマッチングを使用します。埋め込みサービスは利用できません。
トラフィックを増やしたり機能を追加したりする前に、アプリケーションに必要なものを決めます。
機能、モデルライセンス、コンテキスト、入出力レートを比較してください。モデルにリクエストをルーティングする前に、サービスステータスと確認済みのデプロイメント制限を確認してください。
正確なモデルIDと制限された出力でチャット補完形式を使用します。再試行やツールを追加する前に、ストリーミングガイドとエラーガイドを読んでください。
個別のキーと支出上限でアプリケーションを分離します。コンソールは、保留中のリクエストのために予約された金額を含め、使用状況と利用可能クレジットを確認する場所です。
以下に公開されている選択肢を比較し、モデルページを開いて機能、ライセンス、デプロイメントノートを確認します。価格だけでは品質や速度は決まりません。
| モデル | 入力 | 出力 | サービスコンテキスト |
|---|---|---|---|
| LLlama 3.1 8B | $0.03 | $0.05 | 131,072 |
| QQwen3 32B | $0.15 | $0.20 | 131,072 |
| DDeepSeek V3 | $0.25 | $0.85 | 131,072 |
| DDeepSeek R1 | $0.50 | $2.15 | 131,072 |
入出力レートは100万トークンあたりの米ドルです。サービスコンテキストの制限にはデプロイメントの確認が必要です。モデルネイティブの制限とは別です。
使い慣れたツールを文書化された設定で接続してください。トラフィックを移行する前に、選択したデプロイメントでアプリケーションが必要とする機能を検証してください。
カスタムのOpenAI互換チャット接続を構成し、テストメッセージを送信する前にモデル選択を確認します。
チャットインターフェース用にOpenAI API接続を設定し、モデル探索または明示的なモデルフィルターを使用します。
OpenAI Compatibleプロバイダーを準備し、コンテキスト、出力制限、機能設定を実際のデプロイメントに合わせます。
基本的なチェーンでOpenAI Chat Modelから始めます。エージェントワークフローには、個別に検証されたツール呼び出しサポートが必要です。
モデルを選択する前に、アカウント管理、データ処理、デプロイメント要件を確認してください。
ゲートウェイはプロンプトやレスポンスを永続化しません。プロバイダーの保持とインフラストラクチャのログ記録は依然として検証が必要です。これはエンドツーエンドの保持保証ではありません。
入力と出力を別々に比較し、独自のワークロードで見積もります。専用キャパシティは異なる予約モデルに従います。
サポートガイドを使用してエラーを診断し、レポートを作成してください。可用性と監視情報についてはサービスステータスを確認してください。
アプリケーションに組み込む前に、可用性、互換性、コスト、データ処理を理解します。
現在のサインインフローでは身分証明書のアップロードやKYC確認手続きはありません。サインイン済みのアカウントは必要で、利用はそのアカウントに関連付けられます。
WeightsAPIはゲートウェイでコンテンツフィルターを追加しません。カタログには、DolphinやHermesを含む、それぞれの作成者によって公開されたオリジナルモデルとファインチューニングされたバリアントが含まれています。一部のバリアントは拒否を減らすように設計されていますが、モデルのトレーニングによって拒否が発生する可能性があります。各モデルのソースと動作に関する注意事項をお読みください。
APIキーの管理、暗号資産による入金注文の作成、専用GPU注文の実行が可能です。モデルの可用性はサービスステータスで確認してください。支払いクレジットとGPUの有効化には確認が必要です。
APIはChat Completions、レガシーCompletions、モデル検出ルートを使用します。選択したデプロイメントの機能を確認してください。プロバイダー固有のAPIは互換性がありません。
コストは実際の入力トークンと出力トークンに対してモデルごとの個別のレートを使用し、初期のクレジット予約後にプロバイダー確認済みの使用量から決済されます。
ゲートウェイはプロンプトや応答をアプリケーションデータベースに永続化しません。アカウント記録は残り、プロバイダーの保持については個別の検証が必要です。
カタログと小さな例から始めます。ドキュメントはリクエスト形式を説明し、FAQはその周りの決定の解決に役立ちます。