ÎncepețiÎncepe gratuit

Vizualizarea unui set de date despre conținutul de zahăr

În acest exercițiu, vei crea un grafic de dispersie unidimensional pe baza a 25 de măsurători ale conținutului de zahăr din băuturi răcoritoare. Scopul este să vizualizezi grupuri distincte în setul de date, ca prim pas în identificarea unor posibile frontiere de decizie.

Setul de date cu cele 25 de măsurători ale conținutului de zahăr este stocat în coloana sugar_content a cadrului de date df, care a fost preîncărcat pentru tine.

Acest exercițiu face parte din cursul

Support Vector Machines în R

Vezi cursul

Instrucțiuni pentru exercițiu

  • Încarcă pachetul ggplot2.
  • Listează variabilele din cadrul de date df.
  • Completează codul pentru graficul de dispersie. Folosind setul de date df, reprezintă conținutul de zahăr al eșantioanelor pe axa x (la y egal cu zero).
  • Scrie cod ggplot() pentru a afișa conținutul de zahăr din df ca grafic de dispersie. Reușești să identifici două grupuri distincte, corespunzătoare eșantioanelor cu conținut ridicat și, respectiv, scăzut de zahăr?

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Load ggplot2
___

# Print variable names
___

# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) + 
    geom_point() + 
    geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)

# Display plot
plot_df
Editează și rulează codul