Störst hopp för ett namn
Tidigare lade du till en ratio-kolumn för att beskriva förhållandet mellan frekvensen av ett babyname mellan på varandra följande år – ett sätt att mäta hur populärt ett namn har blivit. Nu ska du titta på en delmängd av dessa data, kallad babynames_ratios_filtered, för att undersöka vilka namn som upplevde de största popularitetshoppet mellan på varandra följande år.
babynames_ratios_filtered <- babynames_fraction %>%
arrange(name, year) %>%
group_by(name) %>%
mutate(ratio = fraction / lag(fraction)) %>%
filter(fraction >= 0.00001)
Den här övningen är en del av kursen
Databearbetning med dplyr
Övningsinstruktioner
- Behåll för varje namn i datan den observation (det år) som har det högsta värdet i
ratio-kolumnen; notera att datan redan är grupperad eftername. - Sortera
ratio-kolumnen i fallande ordning. - Filtrera
babynames_ratios_filtered-datan ytterligare genom att filtrerafraction-kolumnen så att endast resultat större än eller lika med0.001visas.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
babynames_ratios_filtered %>%
# Extract the largest ratio from each name
___
# Sort the ratio column in descending order
___
# Filter for fractions greater than or equal to 0.001
___