Aan de slagBegin gratis

Tidy en brede data in tidycensus

Standaard geven tidycensus-functies tidy data frames terug, waarin elke rij een unieke combinatie van eenheid en variabele voorstelt. Soms is het echter handig om elke Census-variabele in een eigen kolom te hebben voor bepaalde vormen van visualisatie en analyse. Hiervoor kun je output = "wide" instellen in je aanroep van get_acs() of get_decennial(). Daarmee komen de schattingen/waarden en marges van fout in eigen kolommen te staan.

Deze oefening maakt deel uit van de cursus

US Census-gegevens analyseren in R

Bekijk cursus

Oefeninstructies

  • Haal ACS-gegevens op over het mediaan huishoudinkomen en de mediane leeftijd voor counties in Oregon in wide-formaat door output = "wide" te specificeren.
  • Bekijk de eerste paar rijen van je brede data frame.
  • Maak een scatterplot van mediaan huishoudinkomen en mediane leeftijd met de functie plot().

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

# Return county data in wide format
or_wide <- get_acs(geography = ___, 
                     ___ = "OR",
                     variables = c(hhincome = "B19013_001", 
                            medage = "B01002_001"), 
                     output = ___)

# Compare output to the tidy format from previous exercises
head(___)

# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)
Code bewerken en uitvoeren