名前の人気が大きく跳ね上がった年
これまでに、ある名前の人気の変化を表すために、連続する年どうしの出現頻度の比を示す ratio 列を追加しました。ここでは、そのデータの一部である babynames_ratios_filtered を使い、連続する年で人気が最も大きく跳ね上がった名前に注目していきます。
babynames_ratios_filtered <- babynames_fraction %>%
arrange(name, year) %>%
group_by(name) %>%
mutate(ratio = fraction / lag(fraction)) %>%
filter(fraction >= 0.00001)
この演習はコースの一部です
dplyr で行うデータ操作
演習の手順
- 各名前ごとに、
ratioが最大となる観測(年)だけを残します。データはすでにnameでグループ化されています。 ratio列を降順に並べ替えます。babynames_ratios_filteredをさらに絞り込み、fraction列が0.001以上の結果のみを表示します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
babynames_ratios_filtered %>%
# Extract the largest ratio from each name
___
# Sort the ratio column in descending order
___
# Filter for fractions greater than or equal to 0.001
___