metadata オブジェクトに、プロキシ制御とトレース属性を含めます。このページでは、会話のアイデンティティを維持し、会話全体をサンプリングして、生成される project のトレースを理解する方法を説明します。
予約済みメタデータ
wandb.* キーはルーティングとログを制御します。プロキシは、プロバイダーにリクエストを送信する前にこれらのキーを削除します。それ以外のメタデータは、プロキシがそのままプロバイダーに転送します。表現可能な場合は、そのメタデータもトレースに追加されます。
会話の優先順位
プロキシは最初に利用可能な識別子を選択します:wandb.thread_idgen_ai.conversation.id- Vapi
call.id
会話全体をサンプリングする
会話単位のトレースサンプリングを使用すると、会話の一部だけを残すことなく、W&B Weave に保存する project のトラフィック量を削減できます。リクエスト単位のサンプリングでは、一部のターンだけが保存され、前後のコンテキストが失われる場合があります。その結果、保存されたデータはデバッグやデータセットの作成に役立ちにくくなります。 project のサンプリングを設定するには、次の手順を実行します。- Model Distillation で、project の Routing ページを開きます。
- Models and traffic で、Weave trace sampling に保存する会話の割合を設定します。
- Save routing を選択します。
API: 会話のトレースサンプリングを設定する (PUT /tasks/[PROXY-MODEL-NAME]/routing)
API: 会話のトレースサンプリングを設定する (PUT /tasks/[PROXY-MODEL-NAME]/routing)
Model Distillation を使用せずに会話単位のトレースサンプリングを設定するには、ルーティング API を使用します。別の project バージョンの場合は、
[PROXY-MODEL-NAME] をプロキシモデル名に、[WANDB-ENTITY] を W&B entity に、[MODEL-REF] を既存のターゲットモデル参照に置き換えます。trace_sampling_rate に 0 から 1 までの値を設定します。ルーティングを更新すると設定全体が置き換えられるため、リクエストには既存のターゲットをすべて含めてください。PUT /v1/tasks/[PROXY-MODEL-NAME]/versions/[PROJECT-VERSION]/routing を使用します。[PROXY-MODEL-NAME] をプロキシモデル名に、[PROJECT-VERSION] を project のバージョンに置き換えます。設定が有効になったと判断する前に、新しいルーティングのリビジョンでデプロイメントのステータスが Applied になるまで待ってください。Project trace contents
project トレースは、以下のルーティング、リクエスト、応答、およびメタデータの詳細を取得します:- プロジェクト ID (UUID)、プロキシモデル名、およびバージョン
- ルーティングリビジョンおよび選択されたプロバイダーとモデル
- プロキシがプロバイダーに送信する正確なリクエストと、プロキシが再構成する応答。
- トークン使用量、完了理由、タイミング、およびエラーステータス
- 応答が exact-response cache (
cache_hit) から再生されたかどうか - 会話、ユーザー、シナリオ、および安全なカスタムメタデータ
- トレース出力のサポートおよび比較のためのプロキシリクエスト ID
API: 会話のアイデンティティ付きでリクエストを送信する (POST /chat/completions)
API: 会話のアイデンティティ付きでリクエストを送信する (POST /chat/completions)
[PROXY-MODEL-NAME] をプロキシモデル名に、[WANDB-ENTITY] を W&B entity に、[CONVERSATION-ID] を会話の識別子に置き換えてください。1 つの会話内のすべてのターンで同じ wandb.thread_id を保持します:wandb.* 値を削除します。ルーティングされたチャット補完を作成する を参照してください。