Очистка строк
На этом уроке мы познакомились с основами «регулярных выражений» (regex), которые позволяют находить общие паттерны в тексте. Мы рассмотрели два обозначения:
| Выражение | Что делает |
|---|---|
. |
соответствует любому символу |
* |
ноль или более повторений |
Например, ".*science " соответствует "data science " в строке "data science rocks!"
Используем полученные знания, чтобы изменить response_var в наборе данных, созданном на предыдущем уроке, — gathered_data.
Это упражнение является частью курса
Категориальные данные в Tidyverse
Инструкции к упражнению
- С помощью
str_removeудалите всё, что стоит перед "rude to " (включая этот фрагмент с пробелом в конце), в столбцеresponse_var. - С помощью
str_removeудалите "on a plane" из столбцаresponse_var.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
gathered_data %>%
# Remove everything before and including "rude to " (with that space at the end!)
mutate(response_var = ___(response_var, ___)) %>%
# Remove "on a plane"
mutate(response_var = ___(response_var, ___))