Skip to main content
このリファレンスでは、Serverless Inference の REST API について説明します。この API を使用すると、独自のアプリケーションからプログラムで基盤モデルを呼び出すことができます。モデルのインフラストラクチャーを管理することなく、ホストされた推論をサービス、スクリプト、ノートブックに統合できます。
この API は、Serverless Inference でホストされているモデルを呼び出します。Dedicated Inference のゲートウェイ、デプロイメント、キャパシティ要求を管理するには、Dedicated Inference API リファレンスを参照してください。Serverless Inference、Dedicated Inference、CKS 上の Inference の比較については、CoreWeave Inference についてを参照してください。

ベース URL

次の URL で Inference サービスにアクセスします:

前提条件

Inference API を呼び出すには、以下が必要です。
  • Inference クレジットがある W&B アカウント。
  • 有効な W&B APIキー。
複数のチームに所属している場合や、使用量を project に紐付けたい場合は、チーム ID と project ID も必要です。コードサンプルでは、これらは [YOUR-TEAM]/[YOUR-PROJECT] と表記されています。これらを指定しない場合、W&B はデフォルトの entity とプロジェクト名 inference を使用します。

利用可能なメソッド

Inference API は、基盤モデルとやり取りするための OpenAI 互換エンドポイントを提供します。以下のメソッドが利用可能です。

認証

すべての API リクエストには、W&B APIキーを使用した認証が必要です。forge.coreweave.com/settings で APIキーを作成してください。 リクエストヘッダーに APIキーを含めてください:
  • OpenAI SDK では、api_key パラメーターを設定してください。
  • API を直接呼び出す場合は、Authorization: Bearer [YOUR-API-KEY] を使用してください。

エラー処理

エラーコードとその解決方法の一覧については、API エラーを参照してください。

次のステップ

APIキーを取得したら、次のいずれかに進んでください。
最終更新日 2026年9月30日