Norul de comparație
Acest exercițiu îți va crea o vizualizare frecvent întâlnită pentru a înțelege frecvența termenilor. Vei analiza cei mai frecvenți termeni din documentele colapsate pozitive și negative. Reamintește-ți TermDocumentMatrix all_tdm pe care l-ai creat anterior. În loc de 1.000 de recenzii ale proprietăților, matricea conține 2 documente cu toate recenziile separate pe baza scorului polarity().
De obicei, este mai simplu să convertești TDM-ul într-o matrice. Apoi redenumești coloanele. Reține că funcția colnames() se apelează în partea stângă a operatorului de atribuire, după cum se arată mai jos.
colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")
După ce termini, vei reordona matricea pentru a vedea cuvintele cel mai pozitive și negative. Analizează acești termeni pentru a putea răspunde la exercițiile de concluzie!
În final, vei vizualiza termenii folosind comparison.cloud().
Acest exercițiu face parte din cursul
Analiza sentimentelor în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Matrix
___
# Column names
colnames(___) <- ___
# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)
# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)
# Top neg words
order_by_neg <- order(___, decreasing = ___)
# Review top 10 neg words
all_tdm_m[___, ] %>% ___