Začněte nyníZačněte zdarma

Souhrnné statistiky pro různé typy vzorků

Máš k dispozici tři typy vzorků (prostý náhodný, stratifikovaný a klastrový) a teď je můžeš porovnat s parametry celé populace. Jinými slovy – vypočítáš stejnou souhrnnou statistiku pro každý vzorek a uvidíš, jak se liší od statistiky pro celou populaci.

Zaměříme se na to, jak spokojenost s firmou ovlivňuje odchod zaměstnanců. Konkrétně vypočítáš podíl zaměstnanců, kteří firmu opustili (jejich hodnota Attrition je "Yes"), pro každou hodnotu RelationshipSatisfaction.

K dispozici máš attrition_pop, attrition_srs, attrition_strat a attrition_clust; balíček dplyr je načtený.

Toto cvičení je součástí kurzu

Vzorkování v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Use the whole population dataset 
mean_attrition_pop <- ___ %>% 
  # Group by relationship satisfaction level
  ___ %>% 
  # Calculate the proportion of employee attrition
  ___

# See the result
mean_attrition_pop
Upravit a spustit kód