この API は、Serverless Inference でホストされているモデルを呼び出します。Dedicated Inference のゲートウェイ、デプロイメント、キャパシティ要求を管理するには、Dedicated Inference API リファレンスを参照してください。Serverless Inference、Dedicated Inference、CKS 上の Inference の比較については、CoreWeave Inference についてを参照してください。
ベース URL
次の URL で Inference サービスにアクセスします:前提条件
Inference API を呼び出すには、以下が必要です。- Inference クレジットがある W&B アカウント。
- 有効な W&B APIキー。
[YOUR-TEAM]/[YOUR-PROJECT] と表記されています。これらを指定しない場合、W&B はデフォルトの entity とプロジェクト名 inference を使用します。
利用可能なメソッド
Inference API は、基盤モデルとやり取りするための OpenAI 互換エンドポイントを提供します。以下のメソッドが利用可能です。認証
すべての API リクエストには、W&B APIキーを使用した認証が必要です。forge.coreweave.com/settings で APIキーを作成してください。 リクエストヘッダーに APIキーを含めてください:- OpenAI SDK では、
api_keyパラメーターを設定してください。 - API を直接呼び出す場合は、
Authorization: Bearer [YOUR-API-KEY]を使用してください。
エラー処理
エラーコードとその解決方法の一覧については、API エラーを参照してください。次のステップ
APIキーを取得したら、次のいずれかに進んでください。- 使用例を試して、API の動作を確認します。
- Inference UI でモデルを確認します。
- アカウントの使用量の制限を確認します。