- Weave の OTel 互換 SDK を使用して、一般的な SDK やハーネスで構築したエージェントをトレースし、メトリクスを収集する
- アプリケーションの LLM Call や任意の関数を手動でインストルメントし、アプリケーションのトレース、バージョン管理、フィードバック収集を行う
- LLM ジャッジモデルやカスタム Scorer を使用して、エージェントやアプリケーションの応答を評価する
はじめに
ワークロードのタイプを選択し、以下のドキュメントを参考にして Weave のツール群の基本的な使い方を確認してください。ワークロードごとの違いについて詳しくは、Weave とは?を参照してください。- エージェントをトレースする
- Op と Call で関数をトレースする
Weave’s agent tracing workflows are also available in CoreWeave Agent Lens, the successor to Weights & Biases Weave. Both services already receive your agent tracing data, so there is nothing to migrate. See What is Agent Lens for more information.
Weave をエージェントと統合する
お使いのエージェント SDK またはハーネスに対応した組み込みインテグレーションを選択し、Agents ビューでセッション、ターン、LLM Call、ツール呼び出しのトレースを開始します。
OpenTelemetry スパンを Agents ビューに送信する
OTel でインストルメントされたエージェントを設定し、Weave の OTLP エンドポイントにトレースをすばやく送信できるようにします。Weave SDK のインストールは不要です。
Weights & Biases UI でエージェントのメトリクスを表示する
LLM への基本的な Call をトレースし、CoreWeave Forge アカウントで入力、出力、コードを確認します。
Weave のインストール
W&B Weave には Python と TypeScript のライブラリが用意されています。Weave ライブラリをインストールするには、次のコマンドを実行します。- Python
- TypeScript
制限と想定される動作
Weave には、以下の制限事項、既知の問題、および想定される動作があります。予期しない結果が発生した場合や、Weave がエッジケースをどのように処理するかを確認したい場合は、この一覧を参照してください。- 再試行可能なリクエストの場合、Weave は最初のエラーを受け取ってから 1 秒後に再試行を開始し、以降は試行間隔を最大 5 分まで倍々に延ばします。リクエストは 36 時間後にタイムアウトします。
-
.call()は例外を送出せず、例外を取得してcall.exceptionに保存します。実行中に例外を送出する必要がある場合は、次のように__should_raiseパラメーター を設定します。showLineNumbers - 専用クラウドの Weave インスタンスでは、別の OpenTelemetry イングレス URL を使用します。正式なエンドポイントの詳細については、OpenTelemetry トレースを送信する を参照してください。
-
Weave は、大きなトレースデータオブジェクトを切り詰めることがあります。これは、デフォルトのトレース出力が、Weave では自動的にシリアライズできない未加工のカスタム Python オブジェクトであるためです。トレースデータをすべて返すには、次のように strings の辞書を定義します。