按县查找规模最大的群体
像 dplyr 和 purrr 这样的包中的 tidyverse 数据整理工具,在探索 Census 数据时非常强大。tidycensus 专为在 tidyverse 生态中进行数据探索而设计。例如,用户可能想要找出某个州内各县规模最大的种族/族裔群体。这可以借助 dplyr 的分组功能完成,先识别每个县在 ACS 中估计值最大的群体,然后筛选保留与该群体匹配的行。
本练习是课程的一部分
在 R 中分析美国人口普查数据
练习说明
- 按
GEOID列对ca_race数据集进行分组。 - 筛选数据集,保留每个分组(县)内
estimate等于该组最大值的行。 - 使用
tally()函数统计加州各县中规模最大的种族/族裔群体分布。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()