Znajdowanie największej grupy w każdym hrabstwie
Narzędzia do przekształcania danych z pakietów tidyverse, takich jak dplyr i purrr, są wyjątkowo przydatne przy eksploracji danych spisowych. Pakiet tidycensus został zaprojektowany z myślą o pracy w środowisku tidyverse. Możesz na przykład sprawdzić, jaka grupa rasowa lub etniczna jest największa w każdym hrabstwie danego stanu. Wystarczy wykorzystać możliwości grupowania z pakietu dplyr – pozwalają one znaleźć najwyższy szacunek dla grupy z ACS i przefiltrować dane tak, aby zachować tylko pasujące wiersze.
To ćwiczenie jest częścią kursu
Analiza danych ze spisu powszechnego USA w R
Instrukcje do ćwiczenia
- Pogrupuj zbiór danych
ca_racewedług kolumnyGEOID. - Przefiltruj zbiór danych tak, aby zachować tylko te wiersze, w których wartość
estimatejest równa maksimum dla danej grupy (hrabstwa). - Użyj funkcji
tally(), aby sprawdzić, jak rozkładają się największe grupy rasowe i etniczne w hrabstwach Kalifornii.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()