Skip to main content
このページでは、W&B Sweeps の実行時に発生する可能性がある一般的なエラーメッセージについて、その原因を特定して解決する方法を説明します。以下のセクションでは、各エラーの内容、発生する理由、および推奨される解決方法を説明します。

CommError, Run does not exist と ERROR Error uploading

W&B がこれら両方のエラーメッセージを返す場合は、W&B の run ID が定義されている可能性があります。たとえば、Jupyter ノートブックや Python スクリプトのどこかで、次のようなコードスニペットを定義していないか確認してください。
sweep では run ID を設定できません。sweep が作成する run には、W&B がランダムな一意の ID を自動的に割り当てるためです。 W&B の run ID は、project 内で一意である必要があります。 表やグラフに表示するカスタム名を設定する場合は、W&B の初期化時に name パラメーターで名前を指定します。例:
wandb.init() から id 引数を削除すると、sweep が一意の run ID を独自に割り当てられるようになり、アップロードエラーは解消されます。

CUDA out of memory

このエラーメッセージが表示された場合は、プロセスベースで実行するようにコードをリファクタリングしてください。各試行を個別のプロセスで実行すると、W&B は run ごとに GPU メモリを解放します。 コードをリファクタリングするには、次の手順を実行します。
  1. コードを train.py という名前の Python スクリプトとして書き直します。YAML 形式の sweep 設定ファイル (この例では config.yaml) に、トレーニングスクリプト名 (train.py) を追加します。
  2. train.py Python スクリプトに次のコードを追加します。
  3. CLI から wandb sweep を使用して sweep を初期化します。
  4. W&B から返される sweep ID を控えておきます。Python SDK (wandb.agent()) ではなく、CLI から wandb agent を使用して sweep ジョブを開始します。次のコードスニペット内の [SWEEP-ID] を、前のステップで W&B から返された sweep ID に置き換えてください。
トレーニングコードを CLI エージェント経由でスクリプトとして実行すると、各試行が個別のプロセスで実行され、W&B は run ごとに GPU メモリを解放します。

anaconda 400 error

次のエラーは通常、最適化対象のメトリクスをログしていない場合に発生します:
YAML ファイルまたはネストされた辞書では、最適化の対象を metric という名前のキーで指定します。このメトリクスは必ず wandb.Run.log() でログしてください。また、Python スクリプトまたは Jupyter ノートブックでは、sweep の最適化対象として定義したメトリクス名とまったく同じ名前を使用してください。設定ファイルの詳細については、sweep 設定を定義するを参照してください。
最終更新日 2026年9月30日