開始使用免費開始

排列列順序

早年音樂還放在 CD 時,有個長年困擾:要怎麼排 CD 才能最快找到想要的?依照歌手名字?依時間順序?還是依曲風分類?

arrange() 函式可以重新排序 tibble 的列。它的引數是 tibble,後面接未加引號的欄位名稱。舉例來說,若要先依欄位 x 的值遞增排序,再在 x 相同時依 y 的值遞減排序,可以這樣寫:

a_tibble %>%
  arrange(x, desc(y))

請注意使用 desc() 來指定遞減排序。此外也要留意,在 sparklyr 中,用於排列 data.frame 列的 order() 函式無法使用。

本練習屬於課程

使用 R 的 sparklyr:Spark 入門

檢視課程

練習說明

我們已為你建立 spark_conn 這個 Spark 連線。連到 Spark 中曲目中繼資料的 tibble 也已預先定義為 track_metadata_tbl

  • 選取 artist_namereleasetitleyear 欄位。
  • 將結果用管線傳給 filter(),篩出 1960 年代的曲目。
  • 再將結果用管線傳給 arrange(),依序以 artist_name、遞減的 year、再來 title 排序。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
編輯並執行程式碼