开始使用免费开始使用

调查分析

分类变量 是只能取有限个可能取值的变量。

在面试前,先用 MASS 包中的 survey 数据集练习清洗分类数据。该数据集包含统计学学生对若干问题的回答。

其中一个问题是学生多长时间锻炼一次。对此问题的答案存放在 Exer 列中。 可用的回答为:

  • "None"
  • "Some",以及
  • "Freq"(经常)。

请注意,这些答案是可以排序的。

回忆一下,tapply() 会对分类中每组取值分别应用一个函数。

例如,

tapply(survey$Age, survey$Sex, median)

按性别计算年龄中位数。

数据集已预加载并存储在变量 survey 中。

本练习是课程的一部分

R 统计面试题实战练习

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Return the structure of Exer
str(___)

# Create the ordered factor 
survey$Exer_ordered <- ___(survey$Exer, ___ = c("None", ___, ___), ordered = ___)

# Return the structure of Exer_ordered
___(___)
编辑并运行代码