Удаление частичных дубликатов
Теперь, когда вы выявили и удалили полные дубликаты, настало время проверить частичные. Работать с частичными дубликатами немного сложнее, чем с полными. В этом упражнении вы сначала найдёте частичные дубликаты, а затем примените наиболее распространённый способ работы с ними — удаление всех частичных дубликатов с сохранением только первой записи.
dplyr загружен, набор данных bike_share_rides доступен.
Это упражнение является частью курса
Очистка данных в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Find duplicated ride_ids
bike_share_rides %>%
# Count the number of occurrences of each ride_id
___ %>%
# Filter for rows with a count > 1
___