开始使用免费开始使用

妈妈的小帮手(1)

如果数据集中有成千上万的列,而您需要选择很多列,那么在调用 select() 时逐个输入列名会非常繁琐。幸运的是,select() 提供了一些辅助函数,可以让您在几乎不需要输入太多代码的情况下一次选择多列。

这些辅助函数包括 starts_with()ends_with(),分别用于匹配以某个前缀开头或以某个后缀结尾的列。由于 dplyr 的特殊代码求值方式,这些函数只能在 select() 的调用中使用;脱离 select() 单独使用并没有意义。

本练习是课程的一部分

R 中使用 sparklyr 的 Spark 入门

查看课程

练习说明

我们已为您创建了名为 spark_conn 的 Spark 连接。存储在 Spark 中的曲目元数据已预先附加为一个名为 track_metadata_tbl 的 tibble。

  • track_metadata_tbl 中选择所有以 "artist" 开头的列。
  • track_metadata_tbl 中选择所有以 "id" 结尾的列。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns starting with artist
  ___

track_metadata_tbl %>%
  # Select columns ending with id
  ___
编辑并运行代码