Zacznij terazZacznij za darmo

Chmura porównawcza

To ćwiczenie pozwoli ci zrozumieć częstotliwość występowania terminów za pomocą popularnej wizualizacji. Przejrzysz najczęściej pojawiające się słowa w zgrupowanych dokumentach pozytywnych i negatywnych. Przypomnij sobie TermDocumentMatrix all_tdm, którą wcześniej utworzyłeś. Zamiast 1000 recenzji wynajmu macierz zawiera 2 dokumenty z wszystkimi recenzjami podzielonymi według wyniku funkcji polarity().

Najwygodniej jest najpierw przekształcić TDM na macierz, a następnie zmienić nazwy kolumn. Pamiętaj, że funkcję colnames() wywołuje się po lewej stronie operatora przypisania, jak pokazano poniżej.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

Następnie posortujesz macierz, aby zobaczyć najbardziej pozytywne i negatywne słowa. Przejrzyj te terminy, bo przyda się to w ćwiczeniach podsumowujących!

Na koniec zwizualizujesz terminy przy użyciu funkcji comparison.cloud().

To ćwiczenie jest częścią kursu

Analiza sentymentu w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Edytuj i uruchom kod