Začněte nyníZačněte zdarma

Vliv slov a frekvenční analýza

Jedním z nejjednodušších způsobů, jak prozkoumat data, je frekvenční analýza. I přes svou jednoduchost dokáže být v analýze sentimentu překvapivě výmluvná. V tomto cvičení sestavíš sloupcový graf. Budeš opět pracovat s moby a bing.

Aby byly sloupce seřazeny od nejnižší po nejvyšší hodnotu, využiješ jeden trik s faktory. Funkce reorder() umožňuje změnit pořadí úrovní faktoru na základě jiné hodnoticí proměnné. V tomto případě seřadíš faktorovou proměnnou term podle hodnoticí proměnné polarity.

Toto cvičení je součástí kurzu

Sentiment Analysis in R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

moby_tidy_sentiment <- moby %>% 
  # Inner join to bing lexicon by term = word
  inner_join(bing, by = c("term" = "word")) %>% 
  # Count by term and sentiment, weighted by count
  count(___, ___, wt = ___) %>%
  # Pivot sentiment, using n as values
  pivot_wider(names_from = ___, values_from = ___, values_fill = ___) %>%
  # Mutate to add a polarity column
  mutate(polarity = ___ - ___)

# Review
moby_tidy_sentiment
Upravit a spustit kód