Začněte nyníZačněte zdarma

Největší skoky v popularitě jména

V předchozím kroku jsi přidal/a sloupec ratio, který popisuje poměr frekvence dětského jména mezi po sobě jdoucími roky a zachycuje změny v jeho popularitě. Teď se podíváš na podmnožinu těchto dat nazvanou babynames_ratios_filtered, abys blíže prozkoumal/a jména, která zaznamenala největší skoky v popularitě v po sobě jdoucích letech.

babynames_ratios_filtered <- babynames_fraction %>%
                     arrange(name, year) %>%
                     group_by(name) %>%
                     mutate(ratio = fraction / lag(fraction)) %>%
                     filter(fraction >= 0.00001)

Toto cvičení je součástí kurzu

Manipulace s daty pomocí dplyr

Zobrazit kurz

Pokyny k cvičení

  • Pro každé jméno v datech ponech pouze pozorování (rok) s nejvyšší hodnotou ratio; data jsou již seskupená podle name.
  • Seřaď sloupec ratio sestupně.
  • Dále vyfiltruj data babynames_ratios_filtered tak, aby sloupec fraction zobrazoval pouze hodnoty větší nebo rovné 0.001.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

babynames_ratios_filtered %>%
  # Extract the largest ratio from each name 
  ___
  # Sort the ratio column in descending order 
  ___
  # Filter for fractions greater than or equal to 0.001
  ___
Upravit a spustit kód