Sammanfattande statistik per grupp
Som en fortsättning på förra övningen använder du här dplyr::summarise() och syntaxen summarise(across(everything(), list())) tillsammans med funktionen group_by() för att beräkna anpassad statistik för specifika variabler uppdelade efter intressanta grupper, till exempel kategorierna sex och adult.
Datamängden abaloneKeep och paketet dplyr är redan inlästa.
Den här övningen är en del av kursen
R för SAS-användare
Övningsinstruktioner
- Beräkna statistik per grupperingsvariabel med hjälp av
summarise()ochgroup_by(). - Beräkna median, 25:e och 75:e percentilen för helkroppsvik per vuxenstatus och namnge utdata som
median_wweight,q1_wweightrespektiveq3_wweight. - Beräkna medelvärde och standardavvikelse för längd och diameter per kön.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(median_wweight = median(___),
q1_wweight = quantile(___, probs = ___),
q3_wweight = quantile(___, probs = ___))
# Get mean and sd for height and diameter by sex
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))