Souhrnné statistiky podle skupin
Navážeme na předchozí cvičení a dál budeme pracovat se syntaxí dplyr::summarise() a summarise(across(everything(), list())) ve spojení s funkcí group_by(). Cílem je vypočítat vlastní statistiky pro vybrané proměnné rozdělené podle skupin, jako jsou kategorie sex a adult.
Dataset abaloneKeep i balíček dplyr jsou už načtené.
Toto cvičení je součástí kurzu
R pro uživatele SAS
Pokyny k cvičení
- Pomocí
summarise()agroup_by()získej statistiky podle skupinové proměnné. - Vypočítej medián, 25. a 75. percentil celkové hmotnosti podle kategorie dospělosti a výstupy pojmenuj
median_wweight,q1_wweightaq3_wweight. - Vypočítej průměr a směrodatnou odchylku výšky a průměru podle pohlaví.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(median_wweight = median(___),
q1_wweight = quantile(___, probs = ___),
q3_wweight = quantile(___, probs = ___))
# Get mean and sd for height and diameter by sex
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))