Ważone ankietowo wykresy gęstości
Kształt rozkładu zmiennej można też zbadać za pomocą gładkiej krzywej gęstości. Stwórzmy wykres gęstości dla liczby godzin snu w nocy, z podziałem na płeć. W odróżnieniu od histogramu, gdzie wysokość słupków odpowiada liczebności, wysokość krzywej gęstości reprezentuje prawdopodobieństwo. Przed utworzeniem wykresu trzeba więc odpowiednio przetworzyć dane.
To ćwiczenie jest częścią kursu
Analiza danych ankietowych w R
Instrukcje do ćwiczenia
- Dla zbioru
NHANESrawusuń wiersze z brakującymi wartościami w kolumnachSleepHrsNightlubGender. - Grupując dane według
Gender, dodaj kolumnęWTMEC4YR_std, której wartości są równeWTMEC4YR/sum(WTMEC4YR). - Przekaż przetworzone dane bezpośrednio do
ggplot(), gdzieSleepHrsNightjest mapowane nax, aWTMEC4YR_std– na wagę. Dodaj warstwę gęstości z parametramibw = 0.6ifill = "gold"oraz warstwę podziału na panele wedługGender.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Density plot of sleep faceted by gender
NHANESraw %>%
___(!is.na(___), !is.na(___)) %>%
group_by(___) %>%
mutate(WTMEC4YR_std = ___) %>%
ggplot(mapping = aes(x = ___, weight = ___)) +
geom____(bw = 0.6, fill = "gold") +
labs(x = "Hours of Sleep") +
____wrap(~___, labeller = "label_both")