开始使用免费开始使用

再次因子化

在上一个练习中,您学习了如何使用 read_sav() 命令导入数据文件。对于 SPSS 数据文件,您导入的某些变量可能属于 labelled 类。这么做是为了保留最初在 .sav.por 文件中存在的标签信息。建议将这些变量强制转换为因子或 R 的其他标准类。

本练习的数据包含员工及其人口统计与经济属性的信息(来源:QRiE)。数据可在以下 URL 获取:

https://assets.datacamp.com/production/course_1478/datasets/employee.sav

本练习是课程的一部分

R 数据导入进阶

查看课程

练习说明

  • 直接从该 URL 导入 SPSS 数据,并将得到的数据框保存为 work
  • 显示 workGENDER 列的摘要。对吧?这些信息并没有提供太多有用内容。
  • work 中的 GENDER 列转换为因子,这是在 R 中表示分类变量的类。请使用 as_factor()
  • 再次显示 GENDER 列的摘要。这一次,输出就更有意义了。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# haven is already loaded

# Import SPSS data from the URL: work


# Display summary of work$GENDER


# Convert work$GENDER to a factor


# Display summary of work$GENDER again
编辑并运行代码