CommencezCommencez gratuitement

Données ordonnées et larges dans tidycensus

Par défaut, les fonctions de tidycensus renvoient des tableaux de données ordonnés (tidy), où chaque ligne représente une combinaison unique unité-variable. Cependant, il est parfois utile d'avoir chaque variable du recensement dans sa propre colonne pour certaines méthodes de visualisation et d'analyse. Pour ce faire, vous pouvez définir output = "wide" dans vos appels à get_acs() ou get_decennial(), ce qui placera les estimations/valeurs et les marges d'erreur dans leurs propres colonnes.

Cette activité fait partie du cours

Analyser les données du recensement des États-Unis avec R

Voir le cours

Instructions de l’exercice

  • Obtenez les données de l'ACS sur le revenu médian des ménages et l'âge médian pour les comtés de l'Oregon au format wide en précisant output = "wide".
  • Vérifiez les premières lignes de votre tableau de données au format large.
  • Créez un nuage de points du revenu médian des ménages et de l'âge médian avec la fonction plot().

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Return county data in wide format
or_wide <- get_acs(geography = ___, 
                     ___ = "OR",
                     variables = c(hhincome = "B19013_001", 
                            medage = "B01002_001"), 
                     output = ___)

# Compare output to the tidy format from previous exercises
head(___)

# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)
Modifier et exécuter le code