母集団と標本分布の平均
標本分布の便利な点のひとつは、数値化できることです。具体的には、その上で要約統計量を計算できます。ここでは、標本分布の平均と母集団パラメータの平均との関係を見ていきます。
3つの標本分布が用意されています。いずれも従業員離職データセットに対して単純無作為抽出を行い、各サンプルで離職率の平均を計算しました。これを1000回繰り返して、離職率平均の標本分布を作成しています。ある標本分布では各反復のサンプルサイズを5、別のものでは50、もう一つでは500に設定しています。
attrition_pop、sampling_distribution_5、sampling_distribution_50、sampling_distribution_500 が利用可能です。numpy は np として読み込まれています。
この演習はコースの一部です
Pythonで学ぶサンプリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Calculate the mean of the mean attritions for each sampling distribution
mean_of_means_5 = ____
mean_of_means_50 = ____
mean_of_means_500 = ____
# Print the results
print(mean_of_means_5)
print(mean_of_means_50)
print(mean_of_means_500)