Графік ядрової щільності
Тепер, коли ви дізналися про графік ядрової щільності, ви можете його побудувати! Пам'ятайте: це згладжена гістограма, на яку не впливає ширина інтервалів. У цій вправі ви побудуєте графік ядрової щільності за значеннями сентименту.
У цій вправі ви побудуєте 2 криві щільності: одну для «Агамемнона», іншу — для «Чарівника країни Оз». Для обох ви виконаєте inner_join() із лексиконом "afinn". Нагадаємо, у лексиконі "afinn" терміни оцінені від -5 до 5. Після перетворення до tidy-формату обидві книги збережуть слова та відповідні оцінки з лексикону.
Потім потрібно об'єднати результати у більший датафрейм за допомогою bind_rows() і створити графік у ggplot2.
Із візуалізації ви зможете зрозуміти, у якій книзі більше позитивної чи негативної лексики. Очевидно, є накладання, адже з Дороті трапляються неприємності, але можна зробити висновок, що ядрова щільність показує вищу ймовірність позитивної мови в «Чарівнику країни Оз» порівняно з «Агамемноном».
Ми завантажили ag та oz як tidy-версії «Агамемнона» та «Чарівника країни Оз» відповідно, а також створили afinn як підмножину лексикону tidytext "afinn".
Ця вправа є частиною курсу
Аналіз тональності в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
ag_afinn <- ag %>%
# Inner join to afinn lexicon
___(___, by = c("term" = "word"))
oz_afinn <- oz %>%
# Inner join to afinn lexicon
___
# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")