Vizualizarea unui set de date despre conținutul de zahăr
În acest exercițiu, vei crea un grafic de dispersie unidimensional pe baza a 25 de măsurători ale conținutului de zahăr din băuturi răcoritoare. Scopul este să vizualizezi grupuri distincte în setul de date, ca prim pas în identificarea unor posibile frontiere de decizie.
Setul de date cu cele 25 de măsurători ale conținutului de zahăr este stocat în coloana sugar_content a cadrului de date df, care a fost preîncărcat pentru tine.
Acest exercițiu face parte din cursul
Support Vector Machines în R
Instrucțiuni pentru exercițiu
- Încarcă pachetul
ggplot2. - Listează variabilele din cadrul de date
df. - Completează codul pentru graficul de dispersie. Folosind setul de date
df, reprezintă conținutul de zahăr al eșantioanelor pe axa x (la y egal cu zero). - Scrie cod
ggplot()pentru a afișa conținutul de zahăr dindfca grafic de dispersie. Reușești să identifici două grupuri distincte, corespunzătoare eșantioanelor cu conținut ridicat și, respectiv, scăzut de zahăr?
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df