Začněte nyníZačněte zdarma

Srovnávací cloud

V tomto cvičení vytvoříš běžnou vizualizaci pro pochopení frekvence výskytů termínů. Konkrétně se podíváš na nejčastější výrazy v pozitivních a negativních sloučených dokumentech. Vzpomeň si na TermDocumentMatrix all_tdm, kterou jsi vytvořil/a dříve. Místo 1 000 recenzí pronájmů obsahuje matice 2 dokumenty se všemi recenzemi rozdělenými podle skóre polarity().

Převod TDM na matici bývá nejpohodlnější. Pak jednoduše přejmenuj sloupce. Pamatuj, že funkce colnames() se volá na levé straně operátoru přiřazení, jak je ukázáno níže.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

Poté matici seřadíš, abys viděl/a nejpozitivnější a nejnegativnější slova. Tyto výrazy si dobře prohlédni – budou se ti hodit při závěrečných cvičeních!

Nakonec výrazy vizualizuješ pomocí comparison.cloud().

Toto cvičení je součástí kurzu

Sentiment Analysis in R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Upravit a spustit kód