开始使用免费开始使用

排序行

在音乐还存放在 CD 的年代,总有一个老问题:怎样给 CD 排序,才能最快找到想要的那张?按艺人?按时间顺序?还是按流派?

arrange() 函数可用于重新排序 tibble 的行。它接收一个 tibble,后面跟未加引号的列名。例如,若要先按列 x 的值升序排序,在 x 相同的情况下再按 y 的值降序排序,可以这样写:

a_tibble %>%
  arrange(x, desc(y))

请注意使用 desc() 来确保按降序排序。还要注意,在 sparklyr 中,用于为 data.frame 排序行的 order() 函数不可用。

本练习是课程的一部分

R 中使用 sparklyr 的 Spark 入门

查看课程

练习说明

我们已经为您创建了名为 spark_conn 的 Spark 连接。指向存储在 Spark 中的曲目信息的 tibble 已预定义为 track_metadata_tbl

  • 选取字段 artist_namereleasetitleyear
  • 将结果通过管道传递,筛选出 1960 年代的曲目。
  • 再将结果通过管道传递给 arrange(),按 artist_name、然后 year 降序、再按 title 排序。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
编辑并运行代码