НачатьНачать бесплатно

Помощники на все случаи жизни (2)

Более универсальный способ отбора столбцов — проверить, содержит ли их название определённое значение в любом месте (а не только в начале или конце). Как вы могли догадаться, для этого служит вспомогательная функция contains().

Ещё более гибкий инструмент — регулярные выражения. Регулярные выражения (сокращённо «regex») — это мощный язык для поиска и сопоставления текста. Если вы хотите освоить их подробнее, пройдите курс String Manipulation with stringr in R. Пока достаточно знать три правила.

  1. a: Буква означает «найти именно эту букву».
  2. .: Точка означает «найти любой символ — букву, цифру, знак препинания и т. д.».
  3. ?: Знак вопроса означает «предыдущий символ является необязательным».

Для поиска столбцов по регулярному выражению используйте вспомогательную функцию matches().

Это упражнение является частью курса

Введение в Spark с sparklyr на R

Посмотреть курс

Инструкции к упражнению

Подключение к Spark уже создано и доступно как spark_conn. Тиббл, привязанный к метаданным треков в Spark, предварительно определён как track_metadata_tbl.

  • Выберите все столбцы из track_metadata_tbl, содержащие "ti".
  • Выберите все столбцы из track_metadata_tbl, соответствующие регулярному выражению "ti.?t".

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns containing ti
  ___

track_metadata_tbl %>%
  # Select columns matching ti.?t
  ___
Редактировать и запускать код