부분 중복 제거하기
이제 완전 중복을 찾아 제거했으니, 부분 중복을 확인해 볼 차례예요. 부분 중복은 완전 중복보다 처리하기가 조금 더 까다롭습니다. 이번 연습 문제에서는 먼저 부분 중복을 식별한 다음, 가장 흔히 쓰이는 처리 방법인 “부분 중복을 모두 삭제하고 첫 번째 항목만 유지”하는 방법을 연습해 보겠습니다.
dplyr는 로드되어 있고 bike_share_rides를 사용할 수 있어요.
이 연습은 강의의 일부입니다
R로 데이터 정리하기
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Find duplicated ride_ids
bike_share_rides %>%
# Count the number of occurrences of each ride_id
___ %>%
# Filter for rows with a count > 1
___