Gráfico de densidade por kernel
Agora que você aprendeu sobre o gráfico de densidade por kernel, pode criar um! Lembre-se: ele é como um histograma suavizado, mas não é afetado pela largura das classes (binwidth). Este exercício vai ajudar você a construir um gráfico de densidade por kernel a partir de valores de sentimento.
Neste exercício, você vai traçar 2 densidades por kernel: uma para Agamemnon e outra para The Wizard of Oz. Para ambos, você fará um inner_join() com o léxico "afinn". Lembre-se de que o léxico "afinn" atribui pontuações de -5 a 5. Já em formato tidy, ambos os livros manterão as palavras e as pontuações correspondentes do léxico.
Depois disso, você precisa unir as linhas dos resultados em um data frame maior usando bind_rows() e criar um gráfico com ggplot2.
Com a visualização, você conseguirá entender qual livro usa mais linguagem positiva versus negativa. Há claramente sobreposição, já que coisas negativas acontecem com Dorothy, mas é possível inferir que a densidade por kernel indica uma maior probabilidade de linguagem positiva em The Wizard of Oz em comparação com Agamemnon.
Carregamos ag e oz como versões tidy de Agamemnon e The Wizard of Oz, respectivamente, e criamos afinn como um subconjunto do léxico "afinn" do tidytext.
Este exercicio faz parte do curso
Análise de Sentimentos em R
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
ag_afinn <- ag %>%
# Inner join to afinn lexicon
___(___, by = c("term" = "word"))
oz_afinn <- oz %>%
# Inner join to afinn lexicon
___
# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")