> ## Documentation Index
> Fetch the complete documentation index at: https://docs.coreweave.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Compare runs with Eval Tables

Eval Tables를 사용하여 여러 run의 입력, 출력 및 점수를 비교하세요. W\&B는 서로 대응하는 예시를 정렬하고 선택한 run의 집계 점수와 점수 차이를 계산합니다.

<Note>
  워크스페이스 수준의 summary 메트릭, 선형 플롯, 고정된 run 또는 기준 run으로 run을 비교하려면 [run 고정 및 비교](/ko/products/wandb/runs/compare-runs)를 참조하세요. Eval Tables는 로깅된 table 내에서 정렬된 예시와 Eval Table별 점수를 비교합니다.
</Note>

run을 비교하려면:

1. 프로젝트 Workspace로 이동하세요.
2. Eval Tables 패널까지 스크롤하세요.
3. **+** 버튼을 선택하세요.
4. 추가할 run을 선택하세요.

W\&B는 선택한 run에서 역할과 이름이 같은 열을 그룹화합니다. 예를 들어 두 run이 동일한 `input_columns`를 사용하면 W\&B는 해당 열을 **Inputs** 섹션에 함께 표시합니다. 마찬가지로 W\&B는 공통 `output_columns`와 `score_columns`를 **Outputs** 및 **Scores** 섹션에 그룹화합니다.

다음 스크린샷은 `summer-butterfly-9`와 `gentle-flower-8` run을 비교하는 Eval Table을 보여줍니다:

<Frame>
  <img src="https://mintcdn.com/coreweave-dbfa0e8d/3Dv_sw2eg8feUJlx/products/wandb/_media/overview_basic_compare_two_runs.png?fit=max&auto=format&n=3Dv_sw2eg8feUJlx&q=85&s=4414d3394d99462237d158e53c586788" alt="Eval Table 뷰" width="2638" height="1844" data-path="products/wandb/_media/overview_basic_compare_two_runs.png" />
</Frame>

<h2 id="set-the-reference-run">
  참조 run 설정
</h2>

여러 run을 비교할 때 W\&B는 기본적으로 맨 왼쪽 run을 참조 run으로 지정합니다. 참조 run은 점수 차이를 계산하는 베이스라인입니다.

다른 참조 run을 선택하려면 해당 run에 마우스를 올리고 메뉴를 연 다음 **Set as reference**를 선택하세요.

<h2 id="view-aggregate-scores">
  집계 점수 보기
</h2>

W\&B는 선택한 각 run의 각 점수 열에 대한 집계 값을 계산합니다. 계산 방식은 점수의 데이터 유형에 따라 달라집니다:

| 점수 유형 | 집계 값 |
| - | - |
| 불리언 | `true` 값의 개수와 비율 |
| 숫자 | 평균 |
| 문자열 또는 범주형 | 스칼라 집계 없음 |
| Null | 계산에서 제외 |

다음 스크린샷은 정답 여부와 신뢰도 점수의 집계 값을 강조하여 보여줍니다:

<Frame>
  <img src="https://mintcdn.com/coreweave-dbfa0e8d/3Dv_sw2eg8feUJlx/products/wandb/_media/overview_basic_compare_two_runs_labled.png?fit=max&auto=format&n=3Dv_sw2eg8feUJlx&q=85&s=95fae414bd40572d9b5f055b67e045a8" alt="Eval Table 뷰" width="2638" height="1844" data-path="products/wandb/_media/overview_basic_compare_two_runs_labled.png" />
</Frame>

<h2 id="compare-score-deltas">
  점수 차이 비교
</h2>

각 점수 열에 대해 W\&B는 참조 run과 선택된 다른 각 run 간의 차이를 계산합니다.

W\&B는 각 차이를 다음과 같이 계산합니다:

```text theme={"system"}
비교 실행 값 - 참조 run 값
```

예를 들어, `summer-butterfly-9`가 참조 run이고 `gentle-flower-8`이 비교 run이라고 가정해 보겠습니다. W\&B는 신뢰도 차이를 다음과 같이 계산합니다:

| `summer-butterfly-9` | `gentle-flower-8` | 차이 |
| - | - | - |
| 0.43 | 0.62 | +0.19 |
| 0.92 | 0.86 | -0.06 |
| 0.97 | 0.85 | -0.12 |

차이가 양수이면 비교 run의 값이 참조 run보다 높다는 의미입니다. 차이가 음수이면 값이 더 낮다는 의미입니다.

다음 스크린샷은 점수 차이를 강조하여 보여줍니다:

<Frame>
  <img src="https://mintcdn.com/coreweave-dbfa0e8d/3Dv_sw2eg8feUJlx/products/wandb/_media/overview_basic_compare_two_runs_delta_labled.png?fit=max&auto=format&n=3Dv_sw2eg8feUJlx&q=85&s=8e57198cebb5b796571a6e7e09ec6e8d" alt="Eval Table 뷰" width="2638" height="1844" data-path="products/wandb/_media/overview_basic_compare_two_runs_delta_labled.png" />
</Frame>


## Related topics

- [Compare evaluations](/ko/products/wandb/weave/guides/evaluation/compare_evals.md)
