Розбийте дані
У цій вправі ви розіб'єте дані на тренувальну та тестову вибірки за допомогою пакета caret. У наступних уроках ви використаєте тренувальну вибірку, щоб побудувати моделі логістичної регресії, а тестову — щоб перевірити ці моделі.
Ця вправа є частиною курсу
HR Analytics: прогнозування плинності кадрів у R
Інструкції до вправи
- Імпортуйте пакет
caret. - Встановіть зерно генератора випадкових чисел 567 і створіть розбиття, яке ділить набір даних
emp_finalна 70% / 30% для тренувальної/тестової частин. - Створіть тренувальну вибірку, вибравши номери рядків, збережені в
index_train, з набору данихemp_final. - Призначте решту спостережень з
emp_finalдо тестової вибірки.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Load caret
___
# Set seed of 567
___
# Store row numbers for training dataset: index_train
index_train <- ___(emp_final$turnover, p = ___, list = FALSE)
# Create training dataset: train_set
train_set <- emp_final[___, ]
# Create testing dataset: test_set
test_set <- emp_final[___, ]