再次因子化
在上一个练习中,您学习了如何使用 read_sav() 命令导入数据文件。对于 SPSS 数据文件,您导入的某些变量可能属于 labelled 类。这么做是为了保留最初在 .sav 和 .por 文件中存在的标签信息。建议将这些变量强制转换为因子或 R 的其他标准类。
本练习的数据包含员工及其人口统计与经济属性的信息(来源:QRiE)。数据可在以下 URL 获取:
https://assets.datacamp.com/production/course_1478/datasets/employee.sav
本练习是课程的一部分
R 数据导入进阶
练习说明
- 直接从该 URL 导入 SPSS 数据,并将得到的数据框保存为
work。 - 显示
work中GENDER列的摘要。对吧?这些信息并没有提供太多有用内容。 - 将
work中的GENDER列转换为因子,这是在 R 中表示分类变量的类。请使用as_factor()。 - 再次显示
GENDER列的摘要。这一次,输出就更有意义了。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# haven is already loaded
# Import SPSS data from the URL: work
# Display summary of work$GENDER
# Convert work$GENDER to a factor
# Display summary of work$GENDER again