Statistiques aléatoires et diagramme de points
En permutant plusieurs fois la variable de propriété du logement, vous générez des écarts de proportions compatibles avec l'hypothèse que les variables ne sont pas liées. La statistique d'intérêt est la différence de proportions, donnée par stat = "diff in props". Après avoir calculé les statistiques aléatoires, vous les représenterez dans un diagramme de points.
Cet exercice illustre les quatre étapes du paquet infer :
specifypermet d'indiquer les variables de réponse et explicative.hypothesizepermet d'énoncer l'hypothèse nulle.generatepermet de générer des rééchantillonnages, des permutations ou des simulations.calculatepermet de calculer des statistiques sommaires.
Chaque étape sera abordée tout au long du cours; dans cet exercice, vous écrirez le code pour calculate().
Les paquets dplyr, ggplot2, NHANES et infer ont été chargés pour vous. Répétez la permutation et le tracé avec 100 différences de proportions générées en brassant la variable HomeOwn.
Cette activité fait partie du cours
Fondements de l'inférence en R
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Perform 100 permutations
homeown_perm <- homes %>%
specify(HomeOwn ~ Gender, success = "Own") %>%
hypothesize(null = "independence") %>%
generate(reps = 100, type = "permute") %>%
___(___, order = ___)
# Print results to console
homeown_perm