Kom igångKom igång gratis

Jämförelsemoln

I den här övningen skapar du en vanlig visualisering för att förstå termfrekvens. Du granskar de vanligast förekommande termerna bland de positiva och negativa sammanslagda dokumenten. Kom ihåg TermDocumentMatrix all_tdm som du skapade tidigare. Istället för 1 000 uthyrningsrecensioner innehåller matrisen 2 dokument med alla recensioner separerade efter polarity()-poäng.

Det är oftast enklare att konvertera TDM:en till en matris. Därefter byter du helt enkelt namn på kolumnerna. Kom ihåg att colnames()-funktionen anropas på vänster sida om tilldelningsoperatorn, som visas nedan.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

När det är klart ordnar du om matrisen för att se de mest positiva och negativa orden. Granska dessa termer så att du kan besvara avslutningsövningarna!

Slutligen visualiserar du termerna med comparison.cloud().

Den här övningen är en del av kursen

Sentimentanalys i R

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Redigera och kör kod