CommencezCommencez gratuitement

Statistiques aléatoires et diagramme de points

En permutant plusieurs fois la variable de propriété du logement, vous générez des écarts de proportions compatibles avec l'hypothèse que les variables ne sont pas liées. La statistique d'intérêt est la différence de proportions, donnée par stat = "diff in props". Après avoir calculé les statistiques aléatoires, vous les représenterez dans un diagramme de points.

Cet exercice illustre les quatre étapes du paquet infer :

  • specify permet d'indiquer les variables de réponse et explicative.
  • hypothesize permet d'énoncer l'hypothèse nulle.
  • generate permet de générer des rééchantillonnages, des permutations ou des simulations.
  • calculate permet de calculer des statistiques sommaires.

Chaque étape sera abordée tout au long du cours; dans cet exercice, vous écrirez le code pour calculate().

Les paquets dplyr, ggplot2, NHANES et infer ont été chargés pour vous. Répétez la permutation et le tracé avec 100 différences de proportions générées en brassant la variable HomeOwn.

Cette activité fait partie du cours

Fondements de l'inférence en R

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Perform 100 permutations
homeown_perm <- homes %>%
  specify(HomeOwn ~ Gender, success = "Own") %>%
  hypothesize(null = "independence") %>% 
  generate(reps = 100, type = "permute") %>% 
  ___(___, order = ___)
  
# Print results to console
homeown_perm
Modifier et exécuter le code