CommencezCommencez gratuitement

Trouver le plus grand groupe par comté

Les outils de transformation de données du tidyverse, comme ceux de dplyr et purrr, sont extrêmement puissants pour explorer les données du recensement. tidycensus est conçu précisément pour faciliter l'exploration de données dans l'écosystème tidyverse. Par exemple, on peut vouloir trouver le plus grand groupe racial/ethnique dans chaque comté pour un État donné. On peut y arriver grâce aux fonctionnalités d'agrégation de dplyr, qui permettent d'identifier la plus grande estimation de groupe de l'ACS et de filtrer pour ne garder que les lignes correspondant à ce groupe.

Cette activité fait partie du cours

Analyser les données du recensement des États-Unis avec R

Voir le cours

Instructions de l’exercice

  • Regroupez le jeu de données ca_race par la colonne GEOID.
  • Filtrez le jeu de données pour ne conserver que les lignes où la valeur estimate est égale au maximum pour son groupe (le comté).
  • Utilisez la fonction tally() pour déterminer la répartition des plus grands groupes raciaux/ethniques dans les comtés de la Californie.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Group the dataset and filter the estimate
ca_largest <- ___ %>%
  group_by(___) %>%
  filter(___ == max(estimate)) 

head(ca_largest)

# Group the dataset and get a breakdown of the results
ca_largest %>% 
  ___(___) %>%
  ___()
Modifier et exécuter le code