ПочатиПочніть безкоштовно

Дані твітів авіаліній

Датафрейм twitter_data містить понад 7 000 твітів про авіалінії. Твіти вже класифіковано як скарги або не скарги у стовпчику complaint_label. Давайте прикинемо, скільки з цих твітів є скаргами.

Зверніть увагу, що це реальні дані з Twitter, тому завжди є ризик, що вони містять нецензурну лексику або інший образливий контент (у цій вправі та будь-яких наступних вправах, де також використовуються реальні дані Twitter).

Ця вправа є частиною курсу

Вступ до аналізу тексту в R

Переглянути курс

Інструкції до вправи

  • Завантажте пакет tidyverse.
  • Оцініть розмір і вміст даних, вивівши twitter_data.
  • Відфільтруйте twitter_data, щоб залишилися лише скарги. Скільки скарг у даних?

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Load the tidyverse packages
___(___)

# Print twitter_data
___

# Print just the complaints in twitter_data
twitter_data %>% 
  ___(___ == ___)
Редагувати та запускати код