異なるサンプルで要約統計量を計算する
これで3種類のサンプル(単純、層化、クラスター)がそろいました。各サンプルの点推定値を母集団のパラメータと比較してみましょう。つまり、各サンプルで同じ要約統計量を計算し、それを母集団の要約統計量と比べます。
ここでは、会社への満足度が退職に影響するかを見ていきます。具体的には、RelationshipSatisfaction の各値ごとに、会社を離れた従業員(Attrition の値が "Yes")の割合を計算します。
attrition_pop、attrition_srs、attrition_strat、attrition_clust が利用可能です。dplyr は読み込まれています。
この演習はコースの一部です
Rで学ぶサンプリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Use the whole population dataset
mean_attrition_pop <- ___ %>%
# Group by relationship satisfaction level
___ %>%
# Calculate the proportion of employee attrition
___
# See the result
mean_attrition_pop