LoslegenKostenlos starten

Vergleichs-Cloud

In dieser Übung erstellst du eine gängige Visualisierung, um die Termhäufigkeit zu verstehen. Konkret schaust du dir die häufigsten Terme in den zu positiven bzw. negativen Dokumenten zusammengefassten Bewertungen an. Erinnerst du dich an die TermDocumentMatrix all_tdm, die du zuvor erstellt hast? Anstelle von 1000 einzelnen Bewertungen enthält die Matrix 2 Dokumente mit allen Bewertungen, getrennt nach dem polarity()-Score.

In der Regel ist es einfacher, die TDM in eine Matrix umzuwandeln. Anschließend benennst du einfach die Spalten um. Denk daran, dass die Funktion colnames() auf der linken Seite des Zuweisungsoperators aufgerufen wird, wie unten gezeigt.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

Danach ordnest du die Matrix neu, um die positivsten und negativsten Wörter zu sehen. Prüfe diese Terme, damit du die Abschlussaufgaben beantworten kannst!

Zum Schluss visualisierst du die Terme mit comparison.cloud().

Diese Übung ist Teil des Kurses

<Kurs>Sentimentanalyse in R</Kurs>
Kurs ansehen

Interaktive praktische Übung

Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Code bearbeiten und ausführen