Comece agoraComece grátis

Gráfico de densidade por kernel

Agora que você aprendeu sobre o gráfico de densidade por kernel, pode criar um! Lembre-se: ele é como um histograma suavizado, mas não é afetado pela largura das classes (binwidth). Este exercício vai ajudar você a construir um gráfico de densidade por kernel a partir de valores de sentimento.

Neste exercício, você vai traçar 2 densidades por kernel: uma para Agamemnon e outra para The Wizard of Oz. Para ambos, você fará um inner_join() com o léxico "afinn". Lembre-se de que o léxico "afinn" atribui pontuações de -5 a 5. Já em formato tidy, ambos os livros manterão as palavras e as pontuações correspondentes do léxico.

Depois disso, você precisa unir as linhas dos resultados em um data frame maior usando bind_rows() e criar um gráfico com ggplot2.

Com a visualização, você conseguirá entender qual livro usa mais linguagem positiva versus negativa. Há claramente sobreposição, já que coisas negativas acontecem com Dorothy, mas é possível inferir que a densidade por kernel indica uma maior probabilidade de linguagem positiva em The Wizard of Oz em comparação com Agamemnon.

Carregamos ag e oz como versões tidy de Agamemnon e The Wizard of Oz, respectivamente, e criamos afinn como um subconjunto do léxico "afinn" do tidytext.

Este exercicio faz parte do curso

Análise de Sentimentos em R

Ver curso

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

ag_afinn <- ag %>% 
  # Inner join to afinn lexicon
  ___(___, by = c("term" = "word"))

oz_afinn <- oz %>% 
  # Inner join to afinn lexicon
  ___ 

# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")
Editar e Executar Código