Grid search 결과 살펴보기
이제 영상에서 정의한 GridSearchCV 객체의 cv_results_ 속성을 살펴보려고 해요. 이는 pandas DataFrame으로 읽을 수 있는 딕셔너리이며, 방금 수행한 grid search에 대한 유용한 정보가 많이 담겨 있어요.
이 속성에 포함된 다양한 열 유형을 다시 한 번 정리하면 다음과 같아요:
time_열param_열(각 하이퍼파라미터별 1개)과 모든 하이퍼파라미터 설정을 담은 단일params열- 각 cv 폴드에 대한
train_score열과 함께mean_train_score,std_train_score열 - 각 cv 폴드에 대한
test_score열과 함께mean_test_score,std_test_score열 - 각 행을
mean_test_score기준으로 1부터 n(반복 횟수)까지 순위를 매기는rank_test_score열
이 연습은 강의의 일부입니다
Python에서의 하이퍼파라미터 튜닝
연습 안내
grid_rf_classGridSearchCV 객체의cv_results_속성을 데이터 프레임으로 읽고 전체를 출력해 확인하세요.- grid search 각 반복에서 사용된 모든 하이퍼파라미터를 담은 딕셔너리가 들어 있는 단일 열을 추출해 출력하세요.
rank_test_score열을 사용해 인덱싱하여, 평균 테스트 점수가 가장 좋았던 행을 추출해 출력하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Read the cv_results property into a dataframe & print it out
cv_results_df = pd.DataFrame(grid_rf_class.____)
print(____)
# Extract and print the column with a dictionary of hyperparameters used
column = cv_results_df.loc[:, [____]]
print(____)
# Extract and print the row that had the best mean test score
best_row = cv_results_df[cv_results_df[____] == ____ ]
print(best_row)