Tworzenie DTM
Utwórz macierz dokumentów i słów (DTM) na podstawie danych tidy_twitter. W tym przypadku każdy tweet traktowany jest jako osobny dokument. Wyświetl tidy_twitter w konsoli, aby sprawdzić nazwy kolumn.
To ćwiczenie jest częścią kursu
Wprowadzenie do analizy tekstu w R
Instrukcje do ćwiczenia
- Zacznij od oczyszczonych danych z Twittera.
- Zlicz, ile razy każde słowo pojawia się w danym tweecie.
- Użyj tych zliczeń, aby utworzyć DTM.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Start with the tidied Twitter data
___ %>%
# Count each word used in each tweet
___(word, ___) %>%
# Use the word counts by tweet to create a DTM
cast_dtm(___, word, n)