가장 큰 인기 급상승 이름
앞서 연속된 해 사이에서 아기 이름의 빈도 비율을 나타내는 ratio 열을 추가해, 이름의 인기 변화를 살펴봤어요. 이제 그 데이터의 하위 집합인 babynames_ratios_filtered를 사용해, 연속된 해에 인기 급상승을 가장 크게 경험한 이름들을 더 자세히 보려고 합니다.
babynames_ratios_filtered <- babynames_fraction %>%
arrange(name, year) %>%
group_by(name) %>%
mutate(ratio = fraction / lag(fraction)) %>%
filter(fraction >= 0.00001)
이 연습은 강의의 일부입니다
dplyr로 데이터 조작하기
연습 안내
- 각 이름별로
ratio가 가장 큰 관측치(연도)만 남기세요. 데이터는 이미name으로 그룹화되어 있습니다. ratio열을 내림차순으로 정렬하세요.fraction열이0.001이상인 결과만 보이도록babynames_ratios_filtered를 추가로 필터링하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
babynames_ratios_filtered %>%
# Extract the largest ratio from each name
___
# Sort the ratio column in descending order
___
# Filter for fractions greater than or equal to 0.001
___