시작하기무료로 시작하기

가장 큰 인기 급상승 이름

앞서 연속된 해 사이에서 아기 이름의 빈도 비율을 나타내는 ratio 열을 추가해, 이름의 인기 변화를 살펴봤어요. 이제 그 데이터의 하위 집합인 babynames_ratios_filtered를 사용해, 연속된 해에 인기 급상승을 가장 크게 경험한 이름들을 더 자세히 보려고 합니다.

babynames_ratios_filtered <- babynames_fraction %>%
                     arrange(name, year) %>%
                     group_by(name) %>%
                     mutate(ratio = fraction / lag(fraction)) %>%
                     filter(fraction >= 0.00001)

이 연습은 강의의 일부입니다

dplyr로 데이터 조작하기

강의 보기

연습 안내

  • 각 이름별로 ratio가 가장 큰 관측치(연도)만 남기세요. 데이터는 이미 name으로 그룹화되어 있습니다.
  • ratio 열을 내림차순으로 정렬하세요.
  • fraction 열이 0.001 이상인 결과만 보이도록 babynames_ratios_filtered를 추가로 필터링하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

babynames_ratios_filtered %>%
  # Extract the largest ratio from each name 
  ___
  # Sort the ratio column in descending order 
  ___
  # Filter for fractions greater than or equal to 0.001
  ___
코드 편집 및 실행