두 개의 샘플
tic_tac_toe 데이터셋으로 여러 분류 모델을 만든 뒤, 일부 모델은 다른 모델만큼 일반화가 잘 되지 않는다는 것을 알게 되었어요. 학습/테스트 분할은 배운 대로 정확히 했는데, 검증이 왜 제대로 되지 않는지 궁금하시죠.
다른 학습/테스트 분할을 시도해 보니 Machine Learning 모델의 정확도가 달라졌어요. 결과가 들쭉날쭉해 답답해지기 전에, 어떤 다른 요인이 있는지 확인해 보기로 했습니다.
이 연습은 강의의 일부입니다
Python에서의 모델 검증
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create two different samples of 200 observations
sample1 = tic_tac_toe.____(____, random_state=1111)
sample2 = tic_tac_toe.____(____, random_state=1171)