Порівняльна хмара
У цій вправі ви створите наочну візуалізацію, щоб краще зрозуміти частоти термінів. Зокрема, ви переглянете найчастотніші терміни серед об'єднаних позитивних і негативних документів. Згадайте TermDocumentMatrix all_tdm, яку ви створили раніше. Замість 1000 відгуків про оренду матриця містить 2 документи з усіма відгуками, розділеними за балом polarity().
Зазвичай зручніше перетворити TDM на звичайну матрицю. Після цього просто перейменуйте стовпці. Пам'ятайте, що функцію colnames() викликають у лівій частині оператора присвоєння, як показано нижче.
colnames(OBJECT) <- c("COLUMN_NAME1", "COLUMN_NAME2")
Коли закінчите, упорядкуйте матрицю, щоб побачити найбільш позитивні та негативні слова. Перегляньте ці терміни, щоб згодом відповісти у вправах із висновками!
Насамкінець ви візуалізуєте терміни за допомогою comparison.cloud().
Ця вправа є частиною курсу
Аналіз тональності в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Matrix
___
# Column names
colnames(___) <- ___
# Top pos words
order_by_pos <- order(all_tdm_m[, ___], decreasing = ___)
# Review top 10 pos words
all_tdm_m[order_by_pos, ] %>% head(___)
# Top neg words
order_by_neg <- order(___, decreasing = ___)
# Review top 10 neg words
all_tdm_m[___, ] %>% ___