母集団と標本分布の平均
標本分布の便利な点のひとつは、定量化できることです。具体的には、その分布に対して要約統計量を計算できます。ここでは、標本分布の平均と、標本抽出で推定したい母集団パラメータとの関係を見ていきます。
3つの標本分布が用意されています。いずれも、従業員離職データセットから単純無作為抽出でサンプリングを行い、各サンプルで離職率の平均を計算しました。これを1000回繰り返して、離職率の平均の標本分布を作成しました。1つは各リプリケートの標本サイズが5、もう1つは50、さらにもう1つは500です。
attrition_pop、sampling_distribution_5、sampling_distribution_50、sampling_distribution_500 が利用可能です。dplyr は読み込まれています。
この演習はコースの一部です
Rで学ぶサンプリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Calculate the mean across replicates of the mean attritions in sampling_distribution_5
mean_of_means_5 <- sampling_distribution_5 %>%
___
# Do the same for sampling_distribution_50
mean_of_means_50 <- ___
# ... and for sampling_distribution_500
mean_of_means_500 <- ___
# See the results
mean_of_means_5
mean_of_means_50
mean_of_means_500