Trực quan hóa bộ dữ liệu hàm lượng đường
Trong bài tập này, bạn sẽ tạo biểu đồ phân tán 1 chiều cho 25 phép đo hàm lượng đường trong nước ngọt. Mục tiêu là trực quan hóa các cụm rõ rệt trong bộ dữ liệu như một bước đầu để xác định các ranh giới quyết định tiềm năng.
Bộ dữ liệu gồm 25 phép đo hàm lượng đường được lưu trong cột sugar_content của data frame df, đã được nạp sẵn cho bạn.
Bài tập này là một phần của khóa học
Support Vector Machines bằng R
Hướng dẫn bài tập
- Nạp package
ggplot2. - Liệt kê các biến trong dataframe
df. - Hoàn thiện mã vẽ biểu đồ phân tán. Dùng bộ dữ liệu
df, vẽ hàm lượng đường của các mẫu trên trục x (tại y bằng 0). - Viết mã
ggplot()để hiển thị hàm lượng đường trongdfdưới dạng biểu đồ phân tán. Bạn có nhận ra hai cụm riêng biệt tương ứng với các mẫu có hàm lượng đường cao và thấp không?
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df