НачатьНачать бесплатно

Очистка строк

На этом уроке мы познакомились с основами «регулярных выражений» (regex), которые позволяют находить общие паттерны в тексте. Мы рассмотрели два обозначения:

Выражение Что делает
. соответствует любому символу
* ноль или более повторений

Например, ".*science " соответствует "data science " в строке "data science rocks!"

Используем полученные знания, чтобы изменить response_var в наборе данных, созданном на предыдущем уроке, — gathered_data.

Это упражнение является частью курса

Категориальные данные в Tidyverse

Посмотреть курс

Инструкции к упражнению

  • С помощью str_remove удалите всё, что стоит перед "rude to " (включая этот фрагмент с пробелом в конце), в столбце response_var.
  • С помощью str_remove удалите "on a plane" из столбца response_var.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

gathered_data %>%
    # Remove everything before and including "rude to " (with that space at the end!)
    mutate(response_var = ___(response_var, ___)) %>%
    # Remove "on a plane"
    mutate(response_var = ___(response_var, ___))
Редактировать и запускать код