Začněte nyníZačněte zdarma

Souhrnné statistiky podle skupin

Navážeme na předchozí cvičení a dál budeme pracovat se syntaxí dplyr::summarise() a summarise(across(everything(), list())) ve spojení s funkcí group_by(). Cílem je vypočítat vlastní statistiky pro vybrané proměnné rozdělené podle skupin, jako jsou kategorie sex a adult.

Dataset abaloneKeep i balíček dplyr jsou už načtené.

Toto cvičení je součástí kurzu

R pro uživatele SAS

Zobrazit kurz

Pokyny k cvičení

  • Pomocí summarise() a group_by() získej statistiky podle skupinové proměnné.
  • Vypočítej medián, 25. a 75. percentil celkové hmotnosti podle kategorie dospělosti a výstupy pojmenuj median_wweight, q1_wweight a q3_wweight.
  • Vypočítej průměr a směrodatnou odchylku výšky a průměru podle pohlaví.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>% 
  group_by(___) %>%
  select(___) %>%
  summarise(median_wweight = median(___),
            q1_wweight = quantile(___, probs = ___),
            q3_wweight = quantile(___, probs = ___))

# Get mean and sd for height and diameter by sex
abaloneKeep %>%
  group_by(___) %>%
  select(___) %>%
  summarise(across(everything(),list(___ = ~ mean(.x),
                                     ___ = ~ sd(.x))))
Upravit a spustit kód