적합도가 가장 높은 모델과 낮은 모델
이번 연습 문제에서는 다음 질문에 답해 보겠습니다.
- 전반적으로 모델이 데이터에 얼마나 잘 적합합니까?
- 적합도가 가장 높은 모델은 무엇입니까?
- 데이터에 잘 적합하지 않는 모델은 무엇입니까?
이 연습은 강의의 일부입니다
Tidyverse로 배우는 Machine Learning
연습 안내
- 77개 모델의 \(R^2\) 값에 대한 히스토그램을 그리세요.
- 적합도가 가장 높은 4개의 모델(\(R^2\) 기준)을 추출하여
best_fit이라는 데이터 프레임에 저장하세요. - 적합도가 가장 낮은 4개의 모델(\(R^2\) 기준)을 추출하여
worst_fit이라는 데이터 프레임에 저장하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Plot a histogram of rsquared for the 77 models
model_perf %>%
ggplot(aes(x = ___)) +
___()
# Extract the 4 best fitting models
best_fit <- model_perf %>%
slice_max(___, n = ___)
# Extract the 4 models with the worst fit
worst_fit <- model_perf %>%
slice_min(___, n = ___)