Помощники на все случаи жизни (2)
Более универсальный способ отбора столбцов — проверить, содержит ли их название определённое значение в любом месте (а не только в начале или конце). Как вы могли догадаться, для этого служит вспомогательная функция contains().
Ещё более гибкий инструмент — регулярные выражения. Регулярные выражения (сокращённо «regex») — это мощный язык для поиска и сопоставления текста. Если вы хотите освоить их подробнее, пройдите курс String Manipulation with stringr in R. Пока достаточно знать три правила.
a: Буква означает «найти именно эту букву»..: Точка означает «найти любой символ — букву, цифру, знак препинания и т. д.».?: Знак вопроса означает «предыдущий символ является необязательным».
Для поиска столбцов по регулярному выражению используйте вспомогательную функцию matches().
Это упражнение является частью курса
Введение в Spark с sparklyr на R
Инструкции к упражнению
Подключение к Spark уже создано и доступно как spark_conn. Тиббл, привязанный к метаданным треков в Spark, предварительно определён как track_metadata_tbl.
- Выберите все столбцы из
track_metadata_tbl, содержащие"ti". - Выберите все столбцы из
track_metadata_tbl, соответствующие регулярному выражению"ti.?t".
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
track_metadata_tbl %>%
# Select columns containing ti
___
track_metadata_tbl %>%
# Select columns matching ti.?t
___