La moyenne des moyennes
Vous voulez connaître le nombre moyen d'utilisatrices et d'utilisateurs (num_users) par entente, mais vous voulez cette valeur pour l'ensemble de l'entreprise afin de voir si les ententes d'Amir comptent plus ou moins d'utilisatrices et d'utilisateurs que la moyenne des ententes de l'entreprise. Le problème, c'est qu'au cours de la dernière année, l'entreprise a travaillé sur plus de dix mille ententes, donc il n'est pas réaliste de compiler toutes les données. À la place, vous allez estimer la moyenne en prenant plusieurs échantillons aléatoires d'ententes, puisque c'est beaucoup plus simple que de recueillir les données de tout le monde dans l'entreprise.
Les données d'utilisatrices et d'utilisateurs pour toutes les ententes de l'entreprise sont disponibles dans all_deals.
Cette activité fait partie du cours
Introduction aux statistiques avec R
Instructions de l’exercice
- Fixez la graine aléatoire à
321. - Prenez 30 échantillons de taille 20 à partir de
all_deals$num_userset calculez la moyenne de chaque échantillon. Stockez les moyennes d'échantillon danssample_means. - Calculez la moyenne de
sample_means. - Calculez la moyenne de la colonne
num_usersdeamir_deals.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Set seed to 321
___
# Take 30 samples of 20 values of num_users, take mean of each sample
sample_means <- ___(___, ___(___, ___) %>% mean())
# Calculate mean of sample_means
___
# Calculate mean of num_users in amir_deals
___