НачатьНачать бесплатно

Обнаружение несогласованных текстовых данных

Недавно поступила новость: команда поддержки клиентов хочет задать участникам опроса SFO несколько дополнительных вопросов. Однако автоматический дозвонщик, которым пользуется колл-центр, не может распознать все номера телефонов, поскольку они записаны в разных форматах. В ходе проверки выяснилось, что часть номеров содержит дефисы (-), а часть — скобки ((, )). В этом упражнении вам нужно определить, в каких номерах есть эти проблемы, чтобы понять, какие из них требуют исправления.

dplyr и stringr загружены, набор данных sfo_survey доступен.

Это упражнение является частью курса

Очистка данных в R

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Filter for rows with "-" in the phone column
sfo_survey %>%
  filter(___)
Редактировать и запускать код