始める無料で始める

母集団と標本分布の平均

標本分布の便利な点のひとつは、定量化できることです。具体的には、その分布に対して要約統計量を計算できます。ここでは、標本分布の平均と、標本抽出で推定したい母集団パラメータとの関係を見ていきます。

3つの標本分布が用意されています。いずれも、従業員離職データセットから単純無作為抽出でサンプリングを行い、各サンプルで離職率の平均を計算しました。これを1000回繰り返して、離職率の平均の標本分布を作成しました。1つは各リプリケートの標本サイズが5、もう1つは50、さらにもう1つは500です。

attrition_popsampling_distribution_5sampling_distribution_50sampling_distribution_500 が利用可能です。dplyr は読み込まれています。

この演習はコースの一部です

Rで学ぶサンプリング

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Calculate the mean across replicates of the mean attritions in sampling_distribution_5
mean_of_means_5 <- sampling_distribution_5 %>%
  ___

# Do the same for sampling_distribution_50
mean_of_means_50 <- ___


# ... and for sampling_distribution_500
mean_of_means_500 <- ___


# See the results
mean_of_means_5
mean_of_means_50
mean_of_means_500
コードを編集して実行