Обнаружение несогласованных текстовых данных
Недавно поступила новость: команда поддержки клиентов хочет задать участникам опроса SFO несколько дополнительных вопросов. Однако автоматический дозвонщик, которым пользуется колл-центр, не может распознать все номера телефонов, поскольку они записаны в разных форматах. В ходе проверки выяснилось, что часть номеров содержит дефисы (-), а часть — скобки ((, )). В этом упражнении вам нужно определить, в каких номерах есть эти проблемы, чтобы понять, какие из них требуют исправления.
dplyr и stringr загружены, набор данных sfo_survey доступен.
Это упражнение является частью курса
Очистка данных в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Filter for rows with "-" in the phone column
sfo_survey %>%
filter(___)