Wpływ słów – analiza częstości
Jednym z najprostszych sposobów eksploracji danych jest analiza częstości. Choć nieskomplikowana, w analizie sentymentu ta prosta metoda potrafi dostarczyć zaskakująco trafnych spostrzeżeń. W tym ćwiczeniu zbudujesz wykres słupkowy. Ponownie pracujesz z obiektami moby i bing.
Aby słupki były ułożone od najniższej do najwyższej wartości, skorzystasz ze sztuczki z czynnikami (ang. factors). Funkcja reorder() pozwala zmieniać kolejność poziomów zmiennej czynnikowej na podstawie innej zmiennej oceniającej. W tym przypadku zmienisz kolejność zmiennej czynnikowej term według zmiennej polarity.
To ćwiczenie jest częścią kursu
Analiza sentymentu w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
moby_tidy_sentiment <- moby %>%
# Inner join to bing lexicon by term = word
inner_join(bing, by = c("term" = "word")) %>%
# Count by term and sentiment, weighted by count
count(___, ___, wt = ___) %>%
# Pivot sentiment, using n as values
pivot_wider(names_from = ___, values_from = ___, values_fill = ___) %>%
# Mutate to add a polarity column
mutate(polarity = ___ - ___)
# Review
moby_tidy_sentiment