Chmura porównawcza
To ćwiczenie pozwoli ci zrozumieć częstotliwość występowania terminów za pomocą popularnej wizualizacji. Przejrzysz najczęściej pojawiające się słowa w zgrupowanych dokumentach pozytywnych i negatywnych. Przypomnij sobie TermDocumentMatrix all_tdm, którą wcześniej utworzyłeś. Zamiast 1000 recenzji wynajmu macierz zawiera 2 dokumenty z wszystkimi recenzjami podzielonymi według wyniku funkcji polarity().
Najwygodniej jest najpierw przekształcić TDM na macierz, a następnie zmienić nazwy kolumn. Pamiętaj, że funkcję colnames() wywołuje się po lewej stronie operatora przypisania, jak pokazano poniżej.
colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")
Następnie posortujesz macierz, aby zobaczyć najbardziej pozytywne i negatywne słowa. Przejrzyj te terminy, bo przyda się to w ćwiczeniach podsumowujących!
Na koniec zwizualizujesz terminy przy użyciu funkcji comparison.cloud().
To ćwiczenie jest częścią kursu
Analiza sentymentu w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Matrix
___
# Column names
colnames(___) <- ___
# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)
# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)
# Top neg words
order_by_neg <- order(___, decreasing = ___)
# Review top 10 neg words
all_tdm_m[___, ] %>% ___