Souhrnné statistiky pro různé typy vzorků
Máš k dispozici tři typy vzorků (prostý náhodný, stratifikovaný a klastrový) a teď je můžeš porovnat s parametry celé populace. Jinými slovy – vypočítáš stejnou souhrnnou statistiku pro každý vzorek a uvidíš, jak se liší od statistiky pro celou populaci.
Zaměříme se na to, jak spokojenost s firmou ovlivňuje odchod zaměstnanců. Konkrétně vypočítáš podíl zaměstnanců, kteří firmu opustili (jejich hodnota Attrition je "Yes"), pro každou hodnotu RelationshipSatisfaction.
K dispozici máš attrition_pop, attrition_srs, attrition_strat a attrition_clust; balíček dplyr je načtený.
Toto cvičení je součástí kurzu
Vzorkování v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Use the whole population dataset
mean_attrition_pop <- ___ %>%
# Group by relationship satisfaction level
___ %>%
# Calculate the proportion of employee attrition
___
# See the result
mean_attrition_pop