Сводная статистика по группам
Продолжая работу с предыдущим упражнением, вы будете использовать синтаксис dplyr::summarise() и summarise(across(everything(), list())) совместно с функцией group_by(), чтобы вычислить пользовательские статистики для отдельных переменных в разрезе интересующих групп — например, категорий sex и adult.
Набор данных abaloneKeep и пакет dplyr уже загружены для вас.
Это упражнение является частью курса
R для пользователей SAS
Инструкции к упражнению
- Получите статистики по группирующей переменной с помощью
summarise()иgroup_by(). - Вычислите медиану, 25-й и 75-й перцентили для общего веса в разрезе категории adult и назовите результаты
median_wweight,q1_wweightиq3_wweight. - Вычислите среднее значение и стандартное отклонение для высоты и диаметра в разрезе категории sex.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(median_wweight = median(___),
q1_wweight = quantile(___, probs = ___),
q3_wweight = quantile(___, probs = ___))
# Get mean and sd for height and diameter by sex
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))