Skip to main content
Model Distillation は 2 つの公開 HTTP サーフェスを公開します。どちらも W&B APIキー で認証されますが、責任範囲とテナンシー制御が異なります。

Management API

UI はこの同じ API を使用します。リソースは永続的で、非同期操作は通常、キューに追加済み、ビルド中、実行中、または保留中の状態とともに 202 Accepted を返します。リクエストを開いたままにするのではなく、リソースの GET エンドポイントをポーリングしてください。 オプションの Wandb-Entity ヘッダーは、アクセス可能なチームを選択します。リソースのパスと本文には、所有する entity を重複して指定しません。

推論プロキシ

OpenAI SDK をプロキシのベース URL とともに使用します。model フィールドはプロキシモデル名/バージョンまたは {プロバイダー}/{モデル} を選択します。リクエストボディ内の metadata["wandb.entity"] を通じてチームのテナンシーが選択されるため、OpenAI SDK 全体で一貫して動作します。

インタラクティブなエンドポイントページ

このセクションのエンドポイントページは、リポジトリにチェックインされた OpenAPI 3.1 仕様から生成されています。両方の API について、リクエストビルダー、スキーマ、応答コード、コピー可能なサンプルが含まれています。

Management API

プロバイダー、project、データセット、ファインチューン、評価、ルーティング、Analytics を管理します。

推論プロキシ

project または登録済みのプロバイダーを経由して、OpenAI 互換の Chat Completions リクエストを送信します。
エージェントは llms.txt を起点に、Management OpenAPI または Inference proxy OpenAPI の仕様ファイルを直接参照できます。
プレイグラウンドからは実際のリクエストが送信されます。データセット、ファインチューン、評価を作成すると、推論リソースやトレーニングリソースが消費される場合があります。また、ルーティング設定を書き換えると、本番トラフィックに影響する可能性があります。
最終更新日 2026年9月30日