НачатьНачать бесплатно

Две выборки

После построения нескольких классификационных моделей на основе набора данных tic_tac_toe вы замечаете, что одни модели обобщают данные лучше, чем другие. Вы создавали обучающие и тестовые разбиения именно так, как вас учили, и вам интересно, почему процесс валидации не работает должным образом.

Попробовав другое разбиение на обучающую и тестовую выборки, вы обнаружили, что точность модели машинного обучения заметно меняется. Прежде чем окончательно расстроиться из-за непостоянных результатов, вы решили разобраться, в чём может быть причина.

Это упражнение является частью курса

Валидация моделей на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Create two different samples of 200 observations 
sample1 = tic_tac_toe.____(____, random_state=1111)
sample2 = tic_tac_toe.____(____, random_state=1171)
Редактировать и запускать код