> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Weave セルフマネージドの取り込みサンプリングを設定する

> 受信トレースの一部のみを保持して、セルフマネージド Weave インスタンス上のストレージと LLM スコアリングのコストを制御します

取り込みサンプリングを使用すると、[セルフマネージド Weave インスタンス](/ja/products/wandb/weave/guides/platform/weave-self-managed) に到着するトレースの割合を制御し、残りを破棄できます。これにより、大量のクラスターにおけるストレージおよび処理コストを軽減できます。指定した割合のトレースのみを保持します。

このガイドでは、セルフマネージド Weave インスタンスでこの機能を有効にする手順を説明します。

<Note>
  取り込みサンプリングを使用するには、サンプラーを含む Weave サーバーバージョンが必要です。`@weave.op` Call のサンプリングには、Weave Python SDK 0.53.0 以降または Weave TypeScript SDK 0.16.0 以降も必要です。エージェント スパンに SDK の要件はありません。詳細は [要件と制限](#requirements-and-limitations) を参照してください。
</Note>

取り込みサンプリングはクライアントサイドのサンプリングとは独立しています。`@weave.op` デコレーターの `tracing_sample_rate` パラメーターは、個別のトレース対象関数が独自の Call をサンプリングできるようにしますが、サーバー側のサンプリング率のみがデプロイメント全体に適用され、個別のクライアントが変更または無視することはできません。詳細は [Control sampling rate](/ja/products/wandb/weave/guides/tracking/ops#control-sampling-rate) を参照してください。

<h2 id="why-use-ingest-sampling">
  取り込みサンプリングを使用する理由
</h2>

デフォルトでは、Weave はアプリケーションが送信するすべてのトレースを保持します。ボリュームが大きくなると、完全な記録を維持するコストが高くなる場合があります。取り込みサンプリングは、トレースをサーバー上で保存またはスコアリングされる前に破棄するため、コストはおおよそ保持するトラフィックの割合に比例します。

取り込みサンプリング率は、`0` から `1` の間の数値を設定することで定義します：

* `1.0` はすべてのトレースを保持し、サンプリングは off です (デフォルト) 。
* `0.1` はトレースの 10% を保持し、残りを破棄します。
* `0.0` は評価を除くすべてのトレースを破棄します。

<h2 id="what-ingest-sampling-applies-to">
  取り込みサンプリングの適用対象
</h2>

取り込みサンプリングは次の 2 種類のトラフィックに適用され、設定したレートは両方に適用されます。

* `@weave.op` デコレーターからの Call。これらは **Traces** タブに表示されます。
* エージェント トレース用エンドポイント (`/agents/otel/v1/traces`) に送信されるエージェント スパン。これらは **Agents** タブに表示されます。詳細については、[エージェントをトレースする](/ja/products/wandb/weave/guides/tracking/trace-agents) を参照してください。

次のトラフィックはサンプリングの対象外で、常にすべて保持されます。

* Weave SDK からの評価。評価は意図的に行う品質測定であり、一部のデータだけでスコアを計算すると正しい値にならないため、Weave はこれらをすべて保持します。
* 独自の OpenTelemetry ツールを使用して raw OTel エンドポイント (`/otel/v1/traces`) に送信されたトレース。raw OpenTelemetry トラフィックには評価を示すマーカーが含まれないため、サンプリングすると評価が気付かないうちに破棄されるおそれがあります。詳細については、[OpenTelemetry トレースを Weave に送信する](/ja/products/wandb/weave/guides/tracking/otel) を参照してください。
* サポートされるバージョンより古い Weave SDK からの Call。[要件と制限](#requirements-and-limitations) を参照してください。

<h2 id="how-it-works">
  仕組み
</h2>

サーバーはトレースの ID と [deterministic hash-based sampling](https://opentelemetry.io/docs/concepts/sampling/) を使用して、どのトレースをドロップし、どのトレースを保持するかを決定します。同じ `trace_id` を持つ複数の Call がトレースに含まれる場合、トレースを保持するかドロップするかというサーバーの判定は、同じトレース ID を共有するネストされた Call やスパンにも適用されます。トレースは全体が保持されるか全体がドロップされるかのいずれかであり、一部だけが保存されることはありません。

<Warning>
  判定が安定するのは、サンプリング率が固定されている間に限られます。サンプリング率の変更時に処理中のトレースは、変更の前後で分割される可能性があります。サンプリング率は、トラフィックの少ない時間帯に変更してください。
</Warning>

<h2 id="configure-ingest-sampling">
  取り込みサンプリングの設定
</h2>

取り込みサンプリングを設定するには、トレースサーバーのデプロイメントで次の環境変数を設定します。たとえば、Helm values を通じて設定します。

| Variable | Type | デフォルト | Meaning |
| - | - | - | - |
| `WEAVE_INGEST_SAMPLE_RATE` | float | `1.0` | 保持するトレースの割合。無効または範囲外の値は `1.0` にデフォルト設定されます。 |
| `WEAVE_INGEST_SAMPLE_DRY_RUN` | bool | `false` | `true` の場合、サーバーは保持または破棄の決定を行い、破棄するものをカウントしますが、何も破棄しません。 |

`WEAVE_INGEST_SAMPLE_RATE` を、保持したいトレースの割合に設定します。たとえば `0.1` です。

<h3 id="optional-preview-with-a-dry-run">
  オプション: dry run でプレビュー
</h3>

サンプリング率の効果を、何もドロップせずにプレビューするには dry run を使用できます。出力はサーバーのサンプリング メトリクスのみで、Datadog などのメトリクス バックエンドにカウンターとして出力されます。デプロイメントでこれらのメトリクスを収集していない場合、dry run は目に見える効果がなく、スキップして直接レートを設定できます。

メトリクスを収集している場合は、代表的なピーク トラフィックをカバーする期間 (例: 丸 1 日) に `WEAVE_INGEST_SAMPLE_RATE=0.1` と `WEAVE_INGEST_SAMPLE_DRY_RUN=true` を指定して実行し、サーバーがどの程度のトラフィックをドロップし、サンプリング対象外のトラフィックがどの程度あるかを確認します。その後 `WEAVE_INGEST_SAMPLE_DRY_RUN=false` を設定してトレースのドロップを開始します。

Call とエージェント スパンは別々のカウンターを報告し、2 つのセットは異なるものをカウントするため、組み合わせるべきではありません。各カウンターにはエンドポイントを識別する `route` タグが付いています。Call カウンターは Call レコードをカウントし、エージェント カウンターはスパンをカウントします (トレース全体ではありません) 。したがって、セット内の比率はトレース数ではなくメッセージ量を反映します。

以下のカウンターは Call を対象としています:

| メトリクス | カウント対象 |
| - | - |
| `ingest_sampling.seen.otel` | サンプラーが評価した Call レコード。 |
| `ingest_sampling.evals_kept.otel` | 保持された評価 Call。 |
| `ingest_sampling.dropped.otel` | ドロップされたレコード。`dry_run` タグが付きます。 |
| `ingest_sampling.dropped_bytes.otel` | ドロップされたバイト数。`dry_run` タグが付きます。 |
| `ingest_sampling.unsupported.otel` | サンプリングできない古いクライアントからのトラフィック。 |
| `ingest_sampling.parse_failures.otel` | 使用可能なトレース ID なしで受信したメッセージ。 |

以下のカウンターはエージェント スパンを対象としています:

| メトリクス | カウント対象 |
| - | - |
| `weave_trace_server.ingest_sampling.spans.seen` | サンプラーが評価したスパン。 |
| `weave_trace_server.ingest_sampling.spans.evals_kept` | 保持された評価スパン。 |
| `weave_trace_server.ingest_sampling.spans.dropped` | ドロップされたスパン。`dry_run` タグが付きます。 |
| `weave_trace_server.ingest_sampling.spans.dropped_bytes` | ドロップされたバイト数。`dry_run` タグが付きます。 |
| `weave_trace_server.ingest_sampling.spans.parse_failures` | 使用可能なトレース ID なしで受信したスパン。 |

<h2 id="requirements-and-limitations">
  要件と制限
</h2>

取り込みサンプリングを有効にする前に、以下の要件、制限、および動作を確認してください:

* **SDK バージョン要件**: サーバーは Weave Python SDK 0.53.0 以降または Weave TypeScript SDK 0.16.0 以降からの Call のみサンプリングします。これらのバージョンは、サーバーがトレースのメッセージをグループ化し、評価 Call を認識するために使用するシグナルを追加します。古い SDK からの Call はサンプリングされず、拒否もされないため、アプリをアップグレードするまで、レートはそのトラフィックに影響しません。エージェント スパンは OpenTelemetry プロトコルの一部としてトレース ID を保持するため、それらのサンプリングに SDK 要件はありません。
* **サーバーバージョン**: エージェント スパンのサポートは Call のサポートの後に追加されました。すでに `1.0` 未満のレートを設定している場合、エージェント スパンをサンプリングするサーバーバージョンにアップグレードすると、同じレートでエージェント トラフィックのサンプリングが開始されます。
* **クライアントの組み合わせによる節約**: raw OpenTelemetry などの古い SDK からのトラフィックなど、サンプリングされないトラフィックはコストを削減しません。トラフィックの多くがこれらのソースからのものである場合、節約はレートが示すよりも小さくなります。dry run はこれを最初に測定する最善の方法です。
* **モニターとスコアリング**: ドロップされたトレースは保存もスコアリングもされません。トラフィックの 100% をカバーするモニターに依存している場合は、サンプリングを有効にする前にこれを考慮してください。
* **クライアントへのドロップシグナルなし**: ドロップされたトレースは通常の成功応答を受け取ります。クライアントはトレースがドロップされたことを通知されません。


## Related topics

- [セルフマネージド W&B Weave インスタンスを設定する](/ja/products/wandb/weave/guides/platform/weave-self-managed.md)
