Začněte nyníZačněte zdarma

Sentiment a emoce

V datasetu sentiments obsahuje lexikon nrc slovník slov a emocí, které jsou s těmito slovy spojeny. Najdeš v něm emoce jako radost, důvěra, anticipace a další.

V datasetu ruských tweetovacích botů, se kterým pracuješ, ses zaměřil/a na tweety od levicového i pravicového bota. Prozkoumej obsah tweetů levicového (demokratického) bota pomocí lexikonu nrc. Levicové tweety left byly tokenizovány na jednotlivá slova a stop-slova byla odstraněna.

Toto cvičení je součástí kurzu

Úvod do zpracování přirozeného jazyka v R

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř tibble obsahující pouze slova anticipace z lexikonu nrc.
  • Vytvoř tibble obsahující pouze slova radosti z lexikonu nrc.
  • Vypiš nejčastější slova anticipation nalezená v left_tokens.
  • Vypiš nejčastější slova joy nalezená v left_tokens.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

left_tokens <- left %>%
  unnest_tokens(output = "word", token = "words", input = content) %>%
  anti_join(stop_words)
# Dictionaries 
anticipation <- ___("nrc") %>% 
  ___(sentiment == "anticipation")
joy <- ___("nrc") %>% 
  ___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
  ___(anticipation, by = "word") %>%
  ___(word, sort = TRUE)
left_tokens %>%
  ___(joy, by = "word") %>%
  ___(word, sort = TRUE)
Upravit a spustit kód