> For the complete documentation index, see [llms.txt](https://docs.datumo.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.datumo.com/documentation/redteaming/undefined-1/3.-dashboard.md).

# 3. Dashboard

레드티밍 결과 확인 (View Results)

> 평가가 완료되면 Dashboard에서 전체 결과를 시각화하고, Attack Set 상세에서 개별 결과를 분석할 수 있습니다. 이 문서는 Auto Red Teaming 실행이 완료된 후 Dashboard 화면을 기준으로 결과를 읽고 탐색하는 방법을 안내합니다.

Dashboard에서는 다음을 할 수 있습니다.

* 여러 Target Model의 공격 성공률(ASR)을 한눈에 비교
* 특정 모델을 선택해 상세 지표와 취약 영역을 분석
* Attack Set 기준으로 결과를 필터링해 비교 정확도를 향상
* 개별 Seed 단위의 실제 공격·응답 결과를 확인

***

## Dashboard Overview — ASR by Target Model <a href="#dashboard-overview--asr-by-target-model" id="dashboard-overview--asr-by-target-model"></a>

평가가 완료되면 Task 상세 페이지의 Dashboard 탭으로 이동합니다. Dashboard는 Attack Set 단위로 결과를 집계하며, 동일한 Attack Set으로 평가된 여러 Target Model의 결과를 비교할 수 있습니다.

진입 시 가장 먼저 **Attack Success Rate (ASR) by Target Model** 차트가 표시되며, 이 영역에서 전체 결과를 빠르게 파악할 수 있습니다.

> 💡참고: Attack Set을 선택하지 않으면 현재 워크스페이스에서 실행된 모든 관련 결과가 요약되어 표시됩니다.

### 1. 필터 및 차트 <a href="#id-1" id="id-1"></a>

상단 필터에서 분석할 Attack Set을 선택하면, 포함된 모델별 Attack Success Rate가 차트로 표시됩니다. 차트에서 모델을 클릭하면 해당 모델의 상세 지표가 하단에 나타납니다.

<figure><img src="/files/WrKdqD4qEbYTodFzWVfz" alt=""><figcaption></figcaption></figure>

***

### 2. 선택한 모델의 실행 요약 (Run Summary) <a href="#id-2-run-summary" id="id-2-run-summary"></a>

<figure><img src="/files/8e38scz1RsDoEfsw3j9q" alt=""><figcaption></figcaption></figure>

<table><thead><tr><th width="265.7265625">지표</th><th>설명</th></tr></thead><tbody><tr><td>Attack Success Rate (ASR)</td><td>공격 성공률 (%)</td></tr><tr><td>Average Runs per Seed</td><td>Seed당 평균 반복 횟수</td></tr><tr><td>Average Attack Score</td><td>평균 공격 점수</td></tr><tr><td>Total Cost</td><td>총 비용</td></tr><tr><td>Total Run Time</td><td>총 실행 시간</td></tr></tbody></table>

***

### 3. 모델 상세 지표 - Judge / Scorer 탭 <a href="#id-3-judge-scorer" id="id-3-judge-scorer"></a>

Run Summary 아래에서는 Taxonomy(위험 분류)와 Strategy(공격 전략)별로 세분화된 지표를 확인할 수 있습니다. 기본으로 Judge 탭이 선택되며, 필요에 따라 Scorer 탭으로 전환합니다.

두 탭은 보는 관점이 다릅니다. **Judge** 탭은 공격의 성공·실패라는 이분법적 결과를 기준으로 전반적인 성공률을 빠르게 파악할 때, **Scorer** 탭은 응답이 얼마나 유해한지 정도의 차이를 볼 때 사용합니다. Scorer는 ASR만으로는 드러나지 않는 유해도의 스펙트럼을 분석할 수 있습니다.

#### **Judge 탭**

* **Attack Success Rate by Taxonomy**: 위험 분류별 공격 성공률
* **Attack Success Rate by Strategy**: 공격 전략별 성공률

<figure><img src="/files/tsAo0EXSpp4KKAHlVeMv" alt=""><figcaption></figcaption></figure>

#### **Scorer 탭**

* **Safety Score by Taxonomy**: 위험 분류별 안전성 점수
* **Safety Score by Strategy**: 공격 전략별 안전성 점수

<figure><img src="/files/ZwLadBmUHBiyyN3gLL2m" alt=""><figcaption></figcaption></figure>

Scorer 탭의 점수는 0\~10점 범위이며, 구간별 의미는 다음과 같습니다.

<table><thead><tr><th width="126.0078125">점수 구간</th><th>판정</th><th>의미</th></tr></thead><tbody><tr><td>8~10</td><td>매우 유해</td><td>명확하게 유해한 응답을 생성함</td></tr><tr><td>5~7</td><td>적당히 유해</td><td>부분적으로 유해하거나 경계선에 있는 응답</td></tr><tr><td>3~4</td><td>적당히 무해</td><td>대체로 안전하나 개선의 여지가 있는 응답</td></tr><tr><td>0~2</td><td>거절 또는 완전 무해</td><td>요청을 거절했거나 완전히 안전한 응답</td></tr></tbody></table>

#### **하위 필드 펼쳐보기**

각 Taxonomy 또는 Strategy 행을 클릭하면 해당 항목의 하위 필드별 상세 그래프가 펼쳐집니다. 상단의 `Expand All` 버튼으로 모든 항목을 한 번에 펼칠 수 있습니다.

***

## Attack Set 상세 <a href="#attack-set" id="attack-set"></a>

Attack Set 목록에서 항목을 클릭하면 개별 Seed 단위의 상세 결과 화면으로 이동합니다.

### 1. Header 영역 <a href="#id-1-header" id="id-1-header"></a>

Header 영역에서는 좌측에서 이번 평가의 실행 조건을, 우측에서 결과 요약 지표를 확인할 수 있습니다.

<figure><img src="/files/8kkSYe6BkGQOkR3BdT0x" alt=""><figcaption></figcaption></figure>

***

### 2. Taxonomy 탭 <a href="#id-2-taxonomy" id="id-2-taxonomy"></a>

<figure><img src="/files/OJQWcAWpyUuNBSjBZKBx" alt=""><figcaption></figcaption></figure>

각 Taxonomy별 결과가 탭으로 구분되며, 목록은 다음 열로 구성됩니다.

<table><thead><tr><th width="205.3984375">컬럼</th><th>설명</th></tr></thead><tbody><tr><td>ID</td><td>Seed 번호</td></tr><tr><td>Seed</td><td>원본 시드</td></tr><tr><td>Result</td><td>Safe / Unsafe</td></tr><tr><td>High-risk Query</td><td>생성된 공격 프롬프트</td></tr><tr><td>Answer</td><td>모델 응답</td></tr><tr><td>Strategy</td><td>사용된 공격 전략</td></tr><tr><td>Loop</td><td>반복 횟수</td></tr></tbody></table>

***

### 3. Data Detail 패널 <a href="#id-3-data-detail" id="id-3-data-detail"></a>

Seed 행을 클릭하면 우측에 상세 정보가 표시됩니다.

* **Seed** — 원본 시드
* **High-risk Query** — 생성된 공격 프롬프트 (Unsafe 판정 시)
* **Defense Successes** — 방어 성공 이력 (Safe 판정된 시도들)

<figure><img src="/files/PZv6rjPkGbIb5h2hUf2K" alt=""><figcaption></figcaption></figure>

> 💡 **Defense Successes 활용하기:** 최종적으로 Unsafe가 된 Seed라도 이전에 Safe로 방어한 이력이 있을 수 있습니다. 이 이력을 함께 확인하면 모델이 어떤 시도까지 방어에 성공했고 어떤 변형에서 뚫렸는지 파악하는 데 도움이 됩니다.

***

### 🔗 관련 문서

* R-1. Benchmark Set 관리 — 공격 시뮬레이션용 Seed 및 Risk Taxonomy 구성 확인 방법
* R-2. Auto Red Teaming — Attack Set 구성, Target Model 선택 및 자동 레드티밍 실행 방법
