НачатьНачать бесплатно

Сортировка строк

В те времена, когда музыку хранили на компакт-дисках, существовала вечная проблема: как лучше упорядочить коллекцию, чтобы быстро найти нужный диск? По исполнителю? По хронологии? По жанру?

Функция arrange() позволяет изменить порядок строк в тибле. Она принимает тибл, а затем имена столбцов без кавычек. Например, чтобы отсортировать строки по возрастанию значений столбца x, а при совпадении значений — по убыванию значений столбца y, используйте следующий код.

a_tibble %>%
  arrange(x, desc(y))

Обратите внимание на функцию desc() — она задаёт сортировку по убыванию. Также учтите, что в sparklyr функция order(), которая используется для сортировки строк в data.frame, не поддерживается.

Это упражнение является частью курса

Введение в Spark с sparklyr на R

Посмотреть курс

Инструкции к упражнению

Подключение к Spark уже создано и доступно как spark_conn. Тибл, связанный с метаданными треков, хранящимися в Spark, предварительно определён как track_metadata_tbl.

  • Выберите поля artist_name, release, title и year.
  • Передайте результат через пайп в filter(), чтобы оставить только треки 1960-х годов.
  • Передайте результат через пайп в arrange() для сортировки по artist_name, затем по убыванию year, затем по title.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
Редактировать и запускать код