1. Learn
  2. /
  3. Курси
  4. /
  5. Аналіз тональності в R

Connected

Вправа

Полярність на реальному тексті

Поки що ви ознайомилися з базовими складниками оцінювання позитивного чи негативного наміру в тексті. Запам'ятайте такі моменти, щоб упевнено тлумачити результати.

  • Суб'єктивний лексикон — це наперед визначений список слів, пов'язаних із емоціями або позитивними/негативними відчуттями.
  • Вам не потрібно перераховувати кожне слово в суб'єктивному лексиконі, адже закон Ципфа описує закономірності людського мовлення.

Швидко почати можна за допомогою функції polarity(), у якій є вбудований суб'єктивний лексикон.

Функція сканує текст, щоб знайти слова з лексикону. Потім вона формує кластер навколо знайденого суб'єктивного слова. У межах цього кластера зміщувачі валентності коригують бал. Зміщувачі валентності — це слова, що підсилюють або заперечують емоційний намір суб'єктивного слова. Наприклад, «well known» є позитивним, тоді як «not well known» — негативним. Тут «not» — це заперечний елемент, який змінює емоційний намір «well known» на протилежний. Натомість «very well known» використовує підсилювач, що збільшує позитивний намір.

Далі polarity() обчислює бал, використовуючи суб'єктивні терміни, зміщувачі валентності та загальну кількість слів у фрагменті. У цій вправі показано просте обчислення полярності. У наступному відео ми заглянемо «під капот» polarity(), щоб розібратися детальніше.

Інструкції 1/2

undefined XP
    1
    2

Обчисліть polarity() для positive в новому об'єкті pos_score. Візьміть увесь виклик у дужки, щоб результат також було надруковано.