按组汇总统计
在上一个练习的基础上,本练习将继续结合使用 dplyr::summarise() 与 summarise(across(everything(), list())) 的语法,并配合 group_by() 函数,对感兴趣的分组(如 sex 与 adult 类别)内的特定变量计算自定义统计量。
abaloneKeep 数据集和 dplyr 包已为您加载。
本练习是课程的一部分
面向 SAS 用户的 R
练习说明
- 使用
summarise()与group_by(),按分组变量计算统计量。 - 按 adult 分组,计算 whole weight 的中位数、第 25 与第 75 个百分位,并分别命名为
median_wweight、q1_wweight和q3_wweight。 - 按 sex 分组,计算 height 与 diameter 的均值和标准差。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(median_wweight = median(___),
q1_wweight = quantile(___, probs = ___),
q3_wweight = quantile(___, probs = ___))
# Get mean and sd for height and diameter by sex
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))