Hitta den största gruppen per county
Databearbetningsverktygen i tidyverse, till exempel i paketen dplyr och purrr, är mycket kraftfulla för att utforska folkräkningsdata. tidycensus är specifikt utformat med dataanalys i tidyverse i åtanke. Man kanske till exempel vill ta reda på vilken ras- eller etnicitetsgrupp som är störst inom varje county i ett givet delstat. Det kan göras med hjälp av grupperingsfunktionerna i dplyr, som gör det möjligt att identifiera den största ACS-gruppskattningen och filtrera bort rader som inte matchar den gruppen.
Den här övningen är en del av kursen
Analysera folkräkningsdata från USA i R
Övningsinstruktioner
- Gruppera datamängden
ca_raceefter kolumnenGEOID. - Filtrera datamängden så att du behåller de rader där värdet på
estimateär lika med det maximala värdet för respektive grupp (county). - Använd funktionen
tally()för att se fördelningen av de största ras- och etnicitetsgrupperna per county i Kalifornien.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()