Kom igångKom igång gratis

Störst hopp för ett namn

Tidigare lade du till en ratio-kolumn för att beskriva förhållandet mellan frekvensen av ett babyname mellan på varandra följande år – ett sätt att mäta hur populärt ett namn har blivit. Nu ska du titta på en delmängd av dessa data, kallad babynames_ratios_filtered, för att undersöka vilka namn som upplevde de största popularitetshoppet mellan på varandra följande år.

babynames_ratios_filtered <- babynames_fraction %>%
                     arrange(name, year) %>%
                     group_by(name) %>%
                     mutate(ratio = fraction / lag(fraction)) %>%
                     filter(fraction >= 0.00001)

Den här övningen är en del av kursen

Databearbetning med dplyr

Visa kurs

Övningsinstruktioner

  • Behåll för varje namn i datan den observation (det år) som har det högsta värdet i ratio-kolumnen; notera att datan redan är grupperad efter name.
  • Sortera ratio-kolumnen i fallande ordning.
  • Filtrera babynames_ratios_filtered-datan ytterligare genom att filtrera fraction-kolumnen så att endast resultat större än eller lika med 0.001 visas.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

babynames_ratios_filtered %>%
  # Extract the largest ratio from each name 
  ___
  # Sort the ratio column in descending order 
  ___
  # Filter for fractions greater than or equal to 0.001
  ___
Redigera och kör kod