1. Learn
  2. /
  3. Курси
  4. /
  5. Аналіз тональності в R

Connected

Вправа

Графік ядрової щільності

Тепер, коли ви дізналися про графік ядрової щільності, ви можете його побудувати! Пам'ятайте: це згладжена гістограма, на яку не впливає ширина інтервалів. У цій вправі ви побудуєте графік ядрової щільності за значеннями сентименту.

У цій вправі ви побудуєте 2 криві щільності: одну для «Агамемнона», іншу — для «Чарівника країни Оз». Для обох ви виконаєте inner_join() із лексиконом "afinn". Нагадаємо, у лексиконі "afinn" терміни оцінені від -5 до 5. Після перетворення до tidy-формату обидві книги збережуть слова та відповідні оцінки з лексикону.

Потім потрібно об'єднати результати у більший датафрейм за допомогою bind_rows() і створити графік у ggplot2.

Із візуалізації ви зможете зрозуміти, у якій книзі більше позитивної чи негативної лексики. Очевидно, є накладання, адже з Дороті трапляються неприємності, але можна зробити висновок, що ядрова щільність показує вищу ймовірність позитивної мови в «Чарівнику країни Оз» порівняно з «Агамемноном».

Ми завантажили ag та oz як tidy-версії «Агамемнона» та «Чарівника країни Оз» відповідно, а також створили afinn як підмножину лексикону tidytext "afinn".

Інструкції 1/2

undefined XP
    1
    2
  • Виконайте inner join ag із лексиконом afinn і збережіть у ag_afinn.
  • Зробіть те саме для «Чарівника країни Оз». Код той самий, але починайте з набору даних oz і збережіть у oz_afinn.
  • Використайте bind_rows(), щоб об'єднати ag_afinn та oz_afinn. Встановіть аргумент .id у значення "book", щоб створити новий стовпець з назвою кожної книги.