ПочатиПочніть безкоштовно

Порівняльна хмара

У цій вправі ви створите наочну візуалізацію, щоб краще зрозуміти частоти термінів. Зокрема, ви переглянете найчастотніші терміни серед об'єднаних позитивних і негативних документів. Згадайте TermDocumentMatrix all_tdm, яку ви створили раніше. Замість 1000 відгуків про оренду матриця містить 2 документи з усіма відгуками, розділеними за балом polarity().

Зазвичай зручніше перетворити TDM на звичайну матрицю. Після цього просто перейменуйте стовпці. Пам'ятайте, що функцію colnames() викликають у лівій частині оператора присвоєння, як показано нижче.

colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")

Коли закінчите, упорядкуйте матрицю, щоб побачити найбільш позитивні та негативні слова. Перегляньте ці терміни, щоб згодом відповісти у вправах із висновками!

Насамкінець ви візуалізуєте терміни за допомогою comparison.cloud().

Ця вправа є частиною курсу

Аналіз тональності в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Matrix
___

# Column names
colnames(___) <- ___

# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)

# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)

# Top neg words
order_by_neg <- order(___, decreasing = ___)

# Review top 10 neg words
all_tdm_m[___, ] %>% ___
Редагувати та запускати код