Vliv slov a frekvenční analýza
Jedním z nejjednodušších způsobů, jak prozkoumat data, je frekvenční analýza. I přes svou jednoduchost dokáže být v analýze sentimentu překvapivě výmluvná. V tomto cvičení sestavíš sloupcový graf. Budeš opět pracovat s moby a bing.
Aby byly sloupce seřazeny od nejnižší po nejvyšší hodnotu, využiješ jeden trik s faktory. Funkce reorder() umožňuje změnit pořadí úrovní faktoru na základě jiné hodnoticí proměnné. V tomto případě seřadíš faktorovou proměnnou term podle hodnoticí proměnné polarity.
Toto cvičení je součástí kurzu
Sentiment Analysis in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
moby_tidy_sentiment <- moby %>%
# Inner join to bing lexicon by term = word
inner_join(bing, by = c("term" = "word")) %>%
# Count by term and sentiment, weighted by count
count(___, ___, wt = ___) %>%
# Pivot sentiment, using n as values
pivot_wider(names_from = ___, values_from = ___, values_fill = ___) %>%
# Mutate to add a polarity column
mutate(polarity = ___ - ___)
# Review
moby_tidy_sentiment