Сортировка строк
В те времена, когда музыку хранили на компакт-дисках, существовала вечная проблема: как лучше упорядочить коллекцию, чтобы быстро найти нужный диск? По исполнителю? По хронологии? По жанру?
Функция arrange() позволяет изменить порядок строк в тибле. Она принимает тибл, а затем имена столбцов без кавычек. Например, чтобы отсортировать строки по возрастанию значений столбца x, а при совпадении значений — по убыванию значений столбца y, используйте следующий код.
a_tibble %>%
arrange(x, desc(y))
Обратите внимание на функцию desc() — она задаёт сортировку по убыванию. Также учтите, что в sparklyr функция order(), которая используется для сортировки строк в data.frame, не поддерживается.
Это упражнение является частью курса
Введение в Spark с sparklyr на R
Инструкции к упражнению
Подключение к Spark уже создано и доступно как spark_conn. Тибл, связанный с метаданными треков, хранящимися в Spark, предварительно определён как track_metadata_tbl.
- Выберите поля
artist_name,release,titleиyear. - Передайте результат через пайп в
filter(), чтобы оставить только треки 1960-х годов. - Передайте результат через пайп в
arrange()для сортировки поartist_name, затем по убываниюyear, затем поtitle.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___