開始使用免費開始

小幫手(1)

當你的資料集有成千上萬個欄位,而且你想一次選取很多欄位時,每次呼叫 select() 都手動打出每個欄位名稱會非常耗時。幸好,select() 提供了一些協助函式,可以讓你用更少的程式碼就選到多個欄位。

這些協助函式包含 starts_with()ends_with(),分別用來比對以特定字首開頭或以特定字尾結束的欄位。由於 dplyr 有特殊的程式碼評估機制,這些函式只能在 select() 的呼叫之中使用;單獨使用並沒有意義。

本練習屬於課程

使用 R 的 sparklyr:Spark 入門

檢視課程

練習說明

我們已為你建立名為 spark_conn 的 Spark 連線。連到儲存在 Spark 中之曲目中繼資料的 tibble 已預先定義為 track_metadata_tbl

  • track_metadata_tbl 中選取所有以 "artist" 開頭的欄位。
  • track_metadata_tbl 中選取所有以 "id" 結尾的欄位。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns starting with artist
  ___

track_metadata_tbl %>%
  # Select columns ending with id
  ___
編輯並執行程式碼