Příprava trénovací, testovací a validační sady
V tomto cvičení využiješ nástroje, které jsi se dosud naučil/a, a sestavíš klasifikační model pro předpověď odchodu zaměstnanců.
Budeš pracovat s datasetem attrition, který obsahuje 30 příznaků o zaměstnancích. Na jejich základě budeš předpovídat, zda daný zaměstnanec společnost opustil.
Nejprve připravíš trénovací a testovací sady, a poté trénovací data dále rozdělíš pomocí křížové validace, abys mohl/a vyhledat nejlépe fungující model pro tento úkol.
Toto cvičení je součástí kurzu
Machine Learning in the Tidyverse
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
set.seed(42)
# Prepare the initial split object
data_split <- initial_split(___, prop = ___)
# Extract the training data frame
training_data <- training(___)
# Extract the testing data frame
testing_data <- testing(___)