Vizualizace datasetu s obsahem cukru
V tomto cvičení vytvoříš jednorozměrný bodový graf z 25 měření obsahu cukru v nealkoholických nápojích. Cílem je vizualizovat výrazné shluky v datasetu jako první krok k identifikaci možných rozhodovacích hranic.
Dataset s 25 měřeními obsahu cukru je uložen ve sloupci sugar_content datového rámce df, který je pro tebe předem načtený.
Toto cvičení je součástí kurzu
Support Vector Machines v R
Pokyny k cvičení
- Načti balíček
ggplot2. - Zobraz seznam proměnných v datovém rámci
df. - Doplň kód bodového grafu. Pomocí datasetu
dfvykresli obsah cukru vzorků podél osy x (při hodnotě y rovné nule). - Napiš kód v
ggplot()pro zobrazení obsahu cukru zdfjako bodový graf. Dokážeš v grafu rozpoznat dva odlišné shluky odpovídající vzorkům s vysokým a nízkým obsahem cukru?
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df