Průměry populace a výběrového rozdělení
Jednou z užitečných vlastností výběrových rozdělení je, že je lze kvantifikovat – konkrétně z nich lze vypočítat souhrnné statistiky. Podíváme se na vztah mezi průměrem výběrového rozdělení a parametrem populace, který má výběr odhadovat.
Máš k dispozici tři výběrová rozdělení. V každém případě byl z datasetu odchodovosti zaměstnanců proveden prostý náhodný výběr a následně byl vypočítán průměr odchodovosti. Tento postup byl zopakován 1 000krát, čímž vzniklo výběrové rozdělení průměrů odchodovosti. Jednotlivá rozdělení se liší velikostí výběru: jedno používalo velikost 5, druhé 50 a třetí 500.
K dispozici máš attrition_pop, sampling_distribution_5, sampling_distribution_50 a sampling_distribution_500; načtena je knihovna dplyr.
Toto cvičení je součástí kurzu
Vzorkování v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Calculate the mean across replicates of the mean attritions in sampling_distribution_5
mean_of_means_5 <- sampling_distribution_5 %>%
___
# Do the same for sampling_distribution_50
mean_of_means_50 <- ___
# ... and for sampling_distribution_500
mean_of_means_500 <- ___
# See the results
mean_of_means_5
mean_of_means_50
mean_of_means_500