skip 参数
在读取不那么整洁的 Excel 文件时,另一个非常有用的参数是 skip。通过 skip,您可以让 R 忽略要读取的 Excel 工作表开头的若干行。请看下面的示例:
read_excel("data.xlsx", skip = 15)
在这个例子中,"data.xlsx" 的第一个工作表中,前 15 行会被忽略。
如果该工作表的第一行包含列名,这些信息也会被 readxl 一并忽略。在这种情况下,请确保将 col_names 设为 FALSE,或者手动指定列名!
文件 urbanpop.xlsx(查看)已在您的目录中;它的列名位于最前面的行。
本练习是课程的一部分
R 数据导入入门
练习说明
- 导入
"urbanpop.xlsx"的第 2 个工作表,但跳过前 21 行。务必设置col_names = FALSE。将结果数据框保存为变量urbanpop_sel。 - 从
urbanpop_sel中选择第一条观测并打印出来。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Import the second sheet of urbanpop.xlsx, skipping the first 21 rows: urbanpop_sel
urbanpop_sel <- read_excel("urbanpop.xlsx", sheet = ___, col_names =___, skip = ___)
# Print out the first observation from urbanpop_sel
___