Statistiques sommaires selon différents types d'échantillons
Vous disposez maintenant de trois types d'échantillons (aléatoire simple, stratifié, en grappes). Vous pouvez donc comparer les estimateurs ponctuels obtenus à partir de chaque échantillon au paramètre de la population. Autrement dit, vous allez calculer la même statistique sommaire pour chaque échantillon et la comparer à celle de la population.
Ici, nous allons examiner comment la satisfaction envers l'entreprise influence le fait qu'une personne salariée quitte ou non l'entreprise. Concrètement, vous calculerez la proportion d'employé·e·s ayant quitté l'entreprise (leur variable Attrition vaut "Yes"), pour chaque valeur de RelationshipSatisfaction.
attrition_pop, attrition_srs, attrition_strat et attrition_clust sont disponibles; dplyr est chargé.
Cette activité fait partie du cours
Échantillonnage en R
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Use the whole population dataset
mean_attrition_pop <- ___ %>%
# Group by relationship satisfaction level
___ %>%
# Calculate the proportion of employee attrition
___
# See the result
mean_attrition_pop