Kom igångKom igång gratis

Visualisera ett dataset med sockerhalter

I den här övningen skapar du ett endimensionellt punktdiagram med 25 mätningar av sockerhalten i läskedrycker. Målet är att visualisera distinkta kluster i datamängden som ett första steg mot att identifiera möjliga beslutsgränser.

Datamängden med 25 sockerhaltsmätningar lagras i kolumnen sugar_content i dataramen df, som redan är inläst åt dig.

Den här övningen är en del av kursen

Support Vector Machines i R

Visa kurs

Övningsinstruktioner

  • Läs in paketet ggplot2.
  • Lista variablerna i dataramen df.
  • Fyll i koden för punktdiagrammet. Använd datamängden df och plotta sockerhalten hos urvalen längs x-axeln (vid y lika med noll).
  • Skriv ggplot()-kod för att visa sockerhalten i df som ett punktdiagram. Kan du se två distinkta kluster som motsvarar urval med hög respektive låg sockerhalt?

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Load ggplot2
___

# Print variable names
___

# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) + 
    geom_point() + 
    geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)

# Display plot
plot_df
Redigera och kör kod