ÎncepețiÎncepe gratuit

Sentiment și emoție

În setul de date sentiments, lexiconul nrc conține un dicționar de cuvinte și emoția asociată fiecăruia. Printre emoțiile prezente în acest set de date se numără bucuria, încrederea, anticiparea și altele.

În setul de date cu tweet-uri ale boților ruși pe care l-ai explorat, ai analizat tweet-uri trimise atât de un bot cu orientare de stânga, cât și de unul cu orientare de dreapta. Explorează conținutul tweet-urilor trimise de botul cu orientare de stânga (democrat) folosind lexiconul nrc. Tweet-urile de stânga, left, au fost tokenizate în cuvinte, cu cuvintele de legătură eliminate.

Acest exercițiu face parte din cursul

Introducere în Prelucrarea Limbajului Natural în R

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează un tibble care să conțină doar cuvintele ce exprimă anticipare din lexiconul nrc.
  • Creează un tibble care să conțină doar cuvintele ce exprimă bucurie din lexiconul nrc.
  • Afișează cele mai frecvente cuvinte din categoria anticipation găsite în left_tokens.
  • Afișează cele mai frecvente cuvinte din categoria joy găsite în left_tokens.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

left_tokens <- left %>%
  unnest_tokens(output = "word", token = "words", input = content) %>%
  anti_join(stop_words)
# Dictionaries 
anticipation <- ___("nrc") %>% 
  ___(sentiment == "anticipation")
joy <- ___("nrc") %>% 
  ___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
  ___(anticipation, by = "word") %>%
  ___(word, sort = TRUE)
left_tokens %>%
  ___(joy, by = "word") %>%
  ___(word, sort = TRUE)
Editează și rulează codul