CommencezCommencez gratuitement

Statistiques sommaires selon différents types d'échantillons

Vous disposez maintenant de trois types d'échantillons (aléatoire simple, stratifié, en grappes). Vous pouvez donc comparer les estimateurs ponctuels obtenus à partir de chaque échantillon au paramètre de la population. Autrement dit, vous allez calculer la même statistique sommaire pour chaque échantillon et la comparer à celle de la population.

Ici, nous allons examiner comment la satisfaction envers l'entreprise influence le fait qu'une personne salariée quitte ou non l'entreprise. Concrètement, vous calculerez la proportion d'employé·e·s ayant quitté l'entreprise (leur variable Attrition vaut "Yes"), pour chaque valeur de RelationshipSatisfaction.

attrition_pop, attrition_srs, attrition_strat et attrition_clust sont disponibles; dplyr est chargé.

Cette activité fait partie du cours

Échantillonnage en R

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Use the whole population dataset 
mean_attrition_pop <- ___ %>% 
  # Group by relationship satisfaction level
  ___ %>% 
  # Calculate the proportion of employee attrition
  ___

# See the result
mean_attrition_pop
Modifier et exécuter le code