혼동 행렬
분류 모델을 막 완성했습니다. 이 모델은 트윗이 좌성향(democrat) 또는 우성향(republican) 트윗 봇에 의해 생성되었는지를 예측합니다. 테스트 데이터에 대해 예측을 수행했고, 다음과 같은 결과가 나왔습니다:
| Predictions | Left | Right |
|---|---|---|
| Left | 350 | 157 |
| Right | 57 | 436 |
위의 혼동 행렬을 사용해 모델의 정확도에 관한 질문에 답하세요.
이 연습은 강의의 일부입니다
R로 배우는 자연어 처리 입문
연습 안내
- 트윗을
Left로 올바르게 라벨링한 비율은 얼마인가요? - 트윗을
Right로 올바르게 라벨링한 비율은 얼마인가요? - 전체 트윗에서 올바르게 라벨링한 비율은 얼마인가요?
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Percentage correctly labeled "Left"
left <- (___) / (350 + 157)
left
# Percentage correctly labeled "Right"
right <- (___) / (___ + ___)
right
# Overall Accuracy:
accuracy <- (___ + ___) / (___ + ___ + ___ + ___)
accuracy