小幫手(1)
當你的資料集有成千上萬個欄位,而且你想一次選取很多欄位時,每次呼叫 select() 都手動打出每個欄位名稱會非常耗時。幸好,select() 提供了一些協助函式,可以讓你用更少的程式碼就選到多個欄位。
這些協助函式包含 starts_with() 與 ends_with(),分別用來比對以特定字首開頭或以特定字尾結束的欄位。由於 dplyr 有特殊的程式碼評估機制,這些函式只能在 select() 的呼叫之中使用;單獨使用並沒有意義。
本練習屬於課程
使用 R 的 sparklyr:Spark 入門
練習說明
我們已為你建立名為 spark_conn 的 Spark 連線。連到儲存在 Spark 中之曲目中繼資料的 tibble 已預先定義為 track_metadata_tbl。
- 從
track_metadata_tbl中選取所有以"artist"開頭的欄位。 - 從
track_metadata_tbl中選取所有以"id"結尾的欄位。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# track_metadata_tbl has been pre-defined
track_metadata_tbl
track_metadata_tbl %>%
# Select columns starting with artist
___
track_metadata_tbl %>%
# Select columns ending with id
___