Visualizando um conjunto de dados de teor de açúcar
Neste exercício, você vai criar um gráfico de dispersão unidimensional com 25 medições de teor de açúcar de refrigerantes. O objetivo é visualizar agrupamentos distintos no conjunto de dados como primeiro passo para identificar possíveis fronteiras de decisão.
O conjunto com 25 medições de teor de açúcar está armazenado na coluna sugar_content do data frame df, que já foi pré-carregado para você.
Este exercicio faz parte do curso
Support Vector Machines em R
Instruções do exercicio
- Carregue o pacote
ggplot2. - Liste as variáveis no dataframe
df. - Complete o código do gráfico de dispersão. Usando o conjunto
df, plote o teor de açúcar das amostras no eixo x (com y igual a zero). - Escreva o código
ggplot()para exibir o teor de açúcar emdfcomo um gráfico de dispersão. Você consegue identificar dois agrupamentos distintos correspondentes a amostras com alto e baixo teor de açúcar?
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df