各地域で最も所得が低い州を見つける
これまでに、複数の dplyr 動詞を組み合わせる方法を学んできました。ここでは、group_by()、summarize()、slice_min() を組み合わせて、各地域で最も所得が高い州を見つけます。
複数の列でグループ化してから要約する場合、summarize() はグループを1つ「はがし」残りのグループ化は維持することを覚えておくことが重要です。たとえば、group_by(X, Y) の後に summarize() すると、結果は引き続き X でグループ化されたままになります。
counties_selected <- counties %>%
select(region, state, county, population, income)
この演習はコースの一部です
dplyr で行うデータ操作
演習の手順
- すでに
group_by()済みであることに注意しつつ、各地域・各州内の郡の平均所得を(average_incomeとして)計算します。 - 各地域で
average_incomeが最も低い州を見つけます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
counties_selected %>%
group_by(region, state) %>%
# Calculate average income
___
# Find the lowest income state in each region
___