Données ordonnées et larges dans tidycensus
Par défaut, les fonctions de tidycensus renvoient des tableaux de données ordonnés (tidy), où chaque ligne représente une combinaison unique unité-variable. Cependant, il est parfois utile d'avoir chaque variable du recensement dans sa propre colonne pour certaines méthodes de visualisation et d'analyse. Pour ce faire, vous pouvez définir output = "wide" dans vos appels à get_acs() ou get_decennial(), ce qui placera les estimations/valeurs et les marges d'erreur dans leurs propres colonnes.
Cette activité fait partie du cours
Analyser les données du recensement des États-Unis avec R
Instructions de l’exercice
- Obtenez les données de l'ACS sur le revenu médian des ménages et l'âge médian pour les comtés de l'Oregon au format wide en précisant
output = "wide". - Vérifiez les premières lignes de votre tableau de données au format large.
- Créez un nuage de points du revenu médian des ménages et de l'âge médian avec la fonction
plot().
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Return county data in wide format
or_wide <- get_acs(geography = ___,
___ = "OR",
variables = c(hhincome = "B19013_001",
medage = "B01002_001"),
output = ___)
# Compare output to the tidy format from previous exercises
head(___)
# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)