妈妈的小帮手(1)
如果数据集中有成千上万的列,而您需要选择很多列,那么在调用 select() 时逐个输入列名会非常繁琐。幸运的是,select() 提供了一些辅助函数,可以让您在几乎不需要输入太多代码的情况下一次选择多列。
这些辅助函数包括 starts_with() 和 ends_with(),分别用于匹配以某个前缀开头或以某个后缀结尾的列。由于 dplyr 的特殊代码求值方式,这些函数只能在 select() 的调用中使用;脱离 select() 单独使用并没有意义。
本练习是课程的一部分
R 中使用 sparklyr 的 Spark 入门
练习说明
我们已为您创建了名为 spark_conn 的 Spark 连接。存储在 Spark 中的曲目元数据已预先附加为一个名为 track_metadata_tbl 的 tibble。
- 从
track_metadata_tbl中选择所有以"artist"开头的列。 - 从
track_metadata_tbl中选择所有以"id"结尾的列。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# track_metadata_tbl has been pre-defined
track_metadata_tbl
track_metadata_tbl %>%
# Select columns starting with artist
___
track_metadata_tbl %>%
# Select columns ending with id
___