Візуалізація набору даних про вміст цукру
У цій вправі ви створите одномірний точковий графік для 25 вимірювань вмісту цукру в безалкогольних напоях. Мета — побачити окремі кластери в наборі даних як перший крок до визначення можливих меж розділення.
Набір із 25 вимірювань зберігається у стовпці sugar_content датафрейму df, який уже завантажено для вас.
Ця вправа є частиною курсу
Support Vector Machines в R
Інструкції до вправи
- Завантажте пакет
ggplot2. - Перелічіть змінні в датафреймі
df. - Завершіть код для точкового графіка. Використовуючи набір даних
df, побудуйте значення вмісту цукру вздовж осі x (при y, що дорівнює нулю). - Напишіть код
ggplot(), щоб відобразити вміст цукру вdfяк точковий графік. Чи бачите ви два окремі кластери, що відповідають зразкам з високим і низьким вмістом цукру?
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df