ПочатиПочніть безкоштовно

Підрахунок типів користувачів

Підрахунки — це базове узагальнення для категоріальних даних. Оскільки текст є категоріальним, важливо впевнено вміти обчислювати підрахунки. У twitter_data є скарги та не-скарги, що позначено у стовпці complaint_label, а також стовпець usr_verified, який вказує, чи підтверджено користувача (тобто Twitter підтвердив, що це саме та людина). Зверніть увагу, що цей стовпець має тип <lgl>, тобто логічний. Чи частіше скаржаться верифіковані користувачі?

Ця вправа є частиною курсу

Вступ до аналізу тексту в R

Переглянути курс

Інструкції до вправи

  • Завантажте пакет tidyverse, до якого входять dplyr і ggplot2.
  • Відфільтруйте дані, щоб залишити лише твіти-скарги.
  • Підрахуйте кількість верифікованих і неверифікованих користувачів, які поскаржилися.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Load the tidyverse package
___(___)

twitter_data %>% 
  # Filter for just the complaints
  ___(___) %>% 
  # Count the number of verified and non-verified users
  ___(___)
Редагувати та запускати код