Tidy en brede data in tidycensus
Standaard geven tidycensus-functies tidy data frames terug, waarin elke rij een unieke combinatie van eenheid en variabele voorstelt. Soms is het echter handig om elke Census-variabele in een eigen kolom te hebben voor bepaalde vormen van visualisatie en analyse. Hiervoor kun je output = "wide" instellen in je aanroep van get_acs() of get_decennial(). Daarmee komen de schattingen/waarden en marges van fout in eigen kolommen te staan.
Deze oefening maakt deel uit van de cursus
US Census-gegevens analyseren in R
Oefeninstructies
- Haal ACS-gegevens op over het mediaan huishoudinkomen en de mediane leeftijd voor counties in Oregon in wide-formaat door
output = "wide"te specificeren. - Bekijk de eerste paar rijen van je brede data frame.
- Maak een scatterplot van mediaan huishoudinkomen en mediane leeftijd met de functie
plot().
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Return county data in wide format
or_wide <- get_acs(geography = ___,
___ = "OR",
variables = c(hhincome = "B19013_001",
medage = "B01002_001"),
output = ___)
# Compare output to the tidy format from previous exercises
head(___)
# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)