Trouver le plus grand groupe par comté
Les outils de transformation de données du tidyverse, comme ceux de dplyr et purrr, sont extrêmement puissants pour explorer les données du recensement. tidycensus est conçu précisément pour faciliter l'exploration de données dans l'écosystème tidyverse. Par exemple, on peut vouloir trouver le plus grand groupe racial/ethnique dans chaque comté pour un État donné. On peut y arriver grâce aux fonctionnalités d'agrégation de dplyr, qui permettent d'identifier la plus grande estimation de groupe de l'ACS et de filtrer pour ne garder que les lignes correspondant à ce groupe.
Cette activité fait partie du cours
Analyser les données du recensement des États-Unis avec R
Instructions de l’exercice
- Regroupez le jeu de données
ca_racepar la colonneGEOID. - Filtrez le jeu de données pour ne conserver que les lignes où la valeur
estimateest égale au maximum pour son groupe (le comté). - Utilisez la fonction
tally()pour déterminer la répartition des plus grands groupes raciaux/ethniques dans les comtés de la Californie.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()