Sentiment a emoce
V datasetu sentiments obsahuje lexikon nrc slovník slov a emocí, které jsou s těmito slovy spojeny. Najdeš v něm emoce jako radost, důvěra, anticipace a další.
V datasetu ruských tweetovacích botů, se kterým pracuješ, ses zaměřil/a na tweety od levicového i pravicového bota. Prozkoumej obsah tweetů levicového (demokratického) bota pomocí lexikonu nrc. Levicové tweety left byly tokenizovány na jednotlivá slova a stop-slova byla odstraněna.
Toto cvičení je součástí kurzu
Úvod do zpracování přirozeného jazyka v R
Pokyny k cvičení
- Vytvoř tibble obsahující pouze slova anticipace z lexikonu
nrc. - Vytvoř tibble obsahující pouze slova radosti z lexikonu
nrc. - Vypiš nejčastější slova
anticipationnalezená vleft_tokens. - Vypiš nejčastější slova
joynalezená vleft_tokens.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
left_tokens <- left %>%
unnest_tokens(output = "word", token = "words", input = content) %>%
anti_join(stop_words)
# Dictionaries
anticipation <- ___("nrc") %>%
___(sentiment == "anticipation")
joy <- ___("nrc") %>%
___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
___(anticipation, by = "word") %>%
___(word, sort = TRUE)
left_tokens %>%
___(joy, by = "word") %>%
___(word, sort = TRUE)