De grootste groep per county zoeken
Gereedschap voor het opschonen en transformeren van gegevens in tidyverse-pakketten zoals dplyr en purrr is enorm krachtig voor het verkennen van Census-gegevens. tidycensus is specifiek ontworpen met gegevensverkenning binnen de tidyverse in gedachten. Zo wil je misschien de grootste raciale/etnische groep binnen elke county voor een bepaalde staat bepalen. Dit kan met dplyr-groeperingsfuncties, waarmee je de grootste ACS-schatting per groep identificeert en vervolgens filtert om alleen de rijen te behouden die bij die groep horen.
Deze oefening maakt deel uit van de cursus
US Census-gegevens analyseren in R
Oefeninstructies
- Groepeer de gegevensset
ca_raceop de kolomGEOID. - Filter de gegevensset zodat alleen die rijen overblijven waar de waarde
estimategelijk is aan het maximum binnen de groep (de county). - Gebruik de functie
tally()om de verdeling van grootste raciale/etnische groepen voor counties in Californië te bepalen.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()