ПочатиПочніть безкоштовно

Графік ядрової щільності

Тепер, коли ви дізналися про графік ядрової щільності, ви можете його побудувати! Пам'ятайте: це згладжена гістограма, на яку не впливає ширина інтервалів. У цій вправі ви побудуєте графік ядрової щільності за значеннями сентименту.

У цій вправі ви побудуєте 2 криві щільності: одну для «Агамемнона», іншу — для «Чарівника країни Оз». Для обох ви виконаєте inner_join() із лексиконом "afinn". Нагадаємо, у лексиконі "afinn" терміни оцінені від -5 до 5. Після перетворення до tidy-формату обидві книги збережуть слова та відповідні оцінки з лексикону.

Потім потрібно об'єднати результати у більший датафрейм за допомогою bind_rows() і створити графік у ggplot2.

Із візуалізації ви зможете зрозуміти, у якій книзі більше позитивної чи негативної лексики. Очевидно, є накладання, адже з Дороті трапляються неприємності, але можна зробити висновок, що ядрова щільність показує вищу ймовірність позитивної мови в «Чарівнику країни Оз» порівняно з «Агамемноном».

Ми завантажили ag та oz як tidy-версії «Агамемнона» та «Чарівника країни Оз» відповідно, а також створили afinn як підмножину лексикону tidytext "afinn".

Ця вправа є частиною курсу

Аналіз тональності в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

ag_afinn <- ag %>% 
  # Inner join to afinn lexicon
  ___(___, by = c("term" = "word"))

oz_afinn <- oz %>% 
  # Inner join to afinn lexicon
  ___ 

# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")
Редагувати та запускати код