Sentiment și emoție
În setul de date sentiments, lexiconul nrc conține un dicționar de cuvinte și emoția asociată fiecăruia. Printre emoțiile prezente în acest set de date se numără bucuria, încrederea, anticiparea și altele.
În setul de date cu tweet-uri ale boților ruși pe care l-ai explorat, ai analizat tweet-uri trimise atât de un bot cu orientare de stânga, cât și de unul cu orientare de dreapta. Explorează conținutul tweet-urilor trimise de botul cu orientare de stânga (democrat) folosind lexiconul nrc. Tweet-urile de stânga, left, au fost tokenizate în cuvinte, cu cuvintele de legătură eliminate.
Acest exercițiu face parte din cursul
Introducere în Prelucrarea Limbajului Natural în R
Instrucțiuni pentru exercițiu
- Creează un tibble care să conțină doar cuvintele ce exprimă anticipare din lexiconul
nrc. - Creează un tibble care să conțină doar cuvintele ce exprimă bucurie din lexiconul
nrc. - Afișează cele mai frecvente cuvinte din categoria
anticipationgăsite înleft_tokens. - Afișează cele mai frecvente cuvinte din categoria
joygăsite înleft_tokens.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
left_tokens <- left %>%
unnest_tokens(output = "word", token = "words", input = content) %>%
anti_join(stop_words)
# Dictionaries
anticipation <- ___("nrc") %>%
___(sentiment == "anticipation")
joy <- ___("nrc") %>%
___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
___(anticipation, by = "word") %>%
___(word, sort = TRUE)
left_tokens %>%
___(joy, by = "word") %>%
___(word, sort = TRUE)