Những cú nhảy lớn nhất của một cái tên
Trước đó, bạn đã thêm cột ratio để mô tả tỉ lệ giữa tần suất của một tên em bé ở hai năm liên tiếp nhằm thể hiện mức độ thay đổi về độ phổ biến của tên đó. Bây giờ, bạn sẽ xem một tập con của dữ liệu đó, gọi là babynames_ratios_filtered, để đi sâu vào các tên có mức tăng độ phổ biến lớn nhất giữa hai năm liên tiếp.
babynames_ratios_filtered <- babynames_fraction %>%
arrange(name, year) %>%
group_by(name) %>%
mutate(ratio = fraction / lag(fraction)) %>%
filter(fraction >= 0.00001)
Bài tập này là một phần của khóa học
Xử lý dữ liệu với dplyr
Hướng dẫn bài tập
- Với mỗi tên trong dữ liệu, giữ lại quan sát (năm) có
ratiolớn nhất; lưu ý dữ liệu đã được nhóm theoname. - Sắp xếp cột
ratiotheo thứ tự giảm dần. - Lọc tiếp dữ liệu
babynames_ratios_filteredbằng cách lọc cộtfractionđể chỉ hiển thị các kết quả lớn hơn hoặc bằng0.001.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
babynames_ratios_filtered %>%
# Extract the largest ratio from each name
___
# Sort the ratio column in descending order
___
# Filter for fractions greater than or equal to 0.001
___