당류 함량 데이터셋 시각화
이 연습 문제에서는 탄산음료 25개 샘플의 당류 함량 측정을 1차원 산점도로 그려 보겠습니다. 이는 데이터셋에서 뚜렷한 군집을 시각화하여, 후보 결정 경계를 찾아가는 첫 단계입니다.
25개의 당류 함량 측정값은 데이터 프레임 df의 sugar_content 열에 저장되어 있으며, 이미 미리 로드되어 있습니다.
이 연습은 강의의 일부입니다
R에서의 Support Vector Machine
연습 안내
ggplot2패키지를 로드하세요.- 데이터프레임
df의 변수를 나열하세요. - 산점도 코드를 완성하세요.
df데이터셋을 사용해 샘플의 당류 함량을 x축에 표시하고, y값은 0으로 두세요. ggplot()코드를 작성해df의 당류 함량을 산점도로 표시하세요. 당류 함량이 높은 샘플과 낮은 샘플에 해당하는 두 개의 뚜렷한 군집이 보이나요?
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df