Wizualizacja zbioru danych o zawartości cukru
W tym ćwiczeniu stworzysz jednowymiarowy wykres punktowy dla 25 pomiarów zawartości cukru w napojach gazowanych. Celem jest wizualizacja wyraźnych skupisk w zbiorze danych – to pierwszy krok w kierunku wyznaczenia kandydatów na granice decyzyjne.
Zbiór danych zawierający 25 pomiarów zawartości cukru jest przechowywany w kolumnie sugar_content ramki danych df, która została już wczytana.
To ćwiczenie jest częścią kursu
Maszyny wektorów nośnych w R
Instrukcje do ćwiczenia
- Załaduj pakiet
ggplot2. - Wyświetl nazwy zmiennych w ramce danych
df. - Uzupełnij kod wykresu punktowego. Korzystając ze zbioru danych
df, wykreśl zawartość cukru w próbkach wzdłuż osi x (przy wartości y równej zero). - Napisz kod
ggplot(), aby wyświetlić zawartość cukru zdfjako wykres punktowy. Czy udaje ci się dostrzec dwa wyraźne skupiska odpowiadające próbkom o wysokiej i niskiej zawartości cukru?
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df