始める無料で始める

郡ごとに最大グループを見つける

dplyrpurrr などのパッケージに含まれる tidyverse のデータラングリングツールは、国勢調査データの探索に非常に役立ちます。tidycensus は、tidyverse 内でのデータ探索を念頭に設計されています。たとえば、特定の州における各郡の最大人種・民族グループを調べたい場合、dplyr のグループ化機能を使うと実現できます。この機能を使うと、ACS の推定値が最大となるグループを特定し、該当する行だけを残すようにフィルタリングできます。

この演習はコースの一部です

R による米国国勢調査データの分析

コースを見る

演習の手順

  • ca_race データセットを GEOID 列でグループ化します。
  • estimate の値がグループ(郡)内の最大値と一致する行だけが残るようにフィルタリングします。
  • tally() 関数を使って、カリフォルニア州の各郡における最大人種・民族グループの内訳を確認しましょう。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Group the dataset and filter the estimate
ca_largest <- ___ %>%
  group_by(___) %>%
  filter(___ == max(estimate)) 

head(ca_largest)

# Group the dataset and get a breakdown of the results
ca_largest %>% 
  ___(___) %>%
  ___()
コードを編集して実行