Trovare il gruppo più numeroso per contea
Gli strumenti di wrangling dei dati del tidyverse, in pacchetti come dplyr e purrr, sono estremamente potenti per esplorare i dati del Censimento. tidycensus è progettato apposta per l'esplorazione dei dati nel tidyverse. Per esempio, potresti voler individuare il gruppo razziale/etnico più numeroso in ogni contea di uno stato. Questo si può fare usando le funzionalità di raggruppamento di dplyr, che permettono di identificare la stima ACS più alta per ciascun gruppo e filtrare per mantenere solo le righe che corrispondono a quel gruppo.
Questo esercizio fa parte del corso
Analizzare i dati del Censimento USA in R
Istruzioni dell'esercizio
- Raggruppa il dataset
ca_raceper la colonnaGEOID. - Filtra il dataset per mantenere le righe in cui il valore di
estimateè uguale al massimo per il suo gruppo (la contea). - Usa la funzione
tally()per ottenere la ripartizione dei gruppi razziali/etnici più numerosi nelle contee della California.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()