不同樣本的摘要統計
現在你已經有三種樣本(簡單、分層、叢集),可以將每個樣本的點估計與母體參數比較。也就是說,你可以在每個樣本上計算相同的摘要統計,然後看看它與母體的摘要統計相差多少。
這裡我們要觀察,對公司的滿意度如何影響員工是否離職。也就是說,你將針對每個 RelationshipSatisfaction 的值,計算離職員工所佔的比例(Attrition 的值為 "Yes")。
已提供 attrition_pop、attrition_srs、attrition_strat 和 attrition_clust;已載入 dplyr。
本練習屬於課程
R 的抽樣
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Use the whole population dataset
mean_attrition_pop <- ___ %>%
# Group by relationship satisfaction level
___ %>%
# Calculate the proportion of employee attrition
___
# See the result
mean_attrition_pop