郡ごとに最大グループを見つける
dplyr や purrr などのパッケージに含まれる tidyverse のデータラングリングツールは、国勢調査データの探索に非常に役立ちます。tidycensus は、tidyverse 内でのデータ探索を念頭に設計されています。たとえば、特定の州における各郡の最大人種・民族グループを調べたい場合、dplyr のグループ化機能を使うと実現できます。この機能を使うと、ACS の推定値が最大となるグループを特定し、該当する行だけを残すようにフィルタリングできます。
この演習はコースの一部です
R による米国国勢調査データの分析
演習の手順
ca_raceデータセットをGEOID列でグループ化します。estimateの値がグループ(郡)内の最大値と一致する行だけが残るようにフィルタリングします。tally()関数を使って、カリフォルニア州の各郡における最大人種・民族グループの内訳を確認しましょう。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()