Visualisera ett dataset med sockerhalter
I den här övningen skapar du ett endimensionellt punktdiagram med 25 mätningar av sockerhalten i läskedrycker. Målet är att visualisera distinkta kluster i datamängden som ett första steg mot att identifiera möjliga beslutsgränser.
Datamängden med 25 sockerhaltsmätningar lagras i kolumnen sugar_content i dataramen df, som redan är inläst åt dig.
Den här övningen är en del av kursen
Support Vector Machines i R
Övningsinstruktioner
- Läs in paketet
ggplot2. - Lista variablerna i dataramen
df. - Fyll i koden för punktdiagrammet. Använd datamängden
dfoch plotta sockerhalten hos urvalen längs x-axeln (vid y lika med noll). - Skriv
ggplot()-kod för att visa sockerhalten idfsom ett punktdiagram. Kan du se två distinkta kluster som motsvarar urval med hög respektive låg sockerhalt?
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df