Kom igångKom igång gratis

Sammanfattande statistik per grupp

Som en fortsättning på förra övningen använder du här dplyr::summarise() och syntaxen summarise(across(everything(), list())) tillsammans med funktionen group_by() för att beräkna anpassad statistik för specifika variabler uppdelade efter intressanta grupper, till exempel kategorierna sex och adult.

Datamängden abaloneKeep och paketet dplyr är redan inlästa.

Den här övningen är en del av kursen

R för SAS-användare

Visa kurs

Övningsinstruktioner

  • Beräkna statistik per grupperingsvariabel med hjälp av summarise() och group_by().
  • Beräkna median, 25:e och 75:e percentilen för helkroppsvik per vuxenstatus och namnge utdata som median_wweight, q1_wweight respektive q3_wweight.
  • Beräkna medelvärde och standardavvikelse för längd och diameter per kön.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>% 
  group_by(___) %>%
  select(___) %>%
  summarise(median_wweight = median(___),
            q1_wweight = quantile(___, probs = ___),
            q3_wweight = quantile(___, probs = ___))

# Get mean and sd for height and diameter by sex
abaloneKeep %>%
  group_by(___) %>%
  select(___) %>%
  summarise(across(everything(),list(___ = ~ mean(.x),
                                     ___ = ~ sd(.x))))
Redigera och kör kod