ÎncepețiÎncepe gratuit

Norul de comparație

Acest exercițiu îți va crea o vizualizare frecvent întâlnită pentru a înțelege frecvența termenilor. Vei analiza cei mai frecvenți termeni din documentele colapsate pozitive și negative. Reamintește-ți TermDocumentMatrix all_tdm pe care l-ai creat anterior. În loc de 1.000 de recenzii ale proprietăților, matricea conține 2 documente cu toate recenziile separate pe baza scorului polarity().

De obicei, este mai simplu să convertești TDM-ul într-o matrice. Apoi redenumești coloanele. Reține că funcția colnames() se apelează în partea stângă a operatorului de atribuire, după cum se arată mai jos.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

După ce termini, vei reordona matricea pentru a vedea cuvintele cel mai pozitive și negative. Analizează acești termeni pentru a putea răspunde la exercițiile de concluzie!

În final, vei vizualiza termenii folosind comparison.cloud().

Acest exercițiu face parte din cursul

Analiza sentimentelor în R

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Editează și rulează codul