Začněte nyníZačněte zdarma

Graf hustoty jádra

Teď, když víš, co je graf hustoty jádra, si ho můžeš vytvořit! Připomeň si, že jde o vyhlazený histogram, který není ovlivněn šířkou sloupce. V tomto cvičení si z hodnot sentimentu sestavíš vlastní graf hustoty jádra.

Budeš zobrazovat 2 křivky hustoty – jednu pro Agamemnona a druhou pro Čaroděje ze země Oz. U obou provedeš inner_join() s lexikonem "afinn". Vzpomeň si, že lexikon "afinn" hodnotí výrazy na škále od -5 do 5. Po převedení do tidy formátu si každá kniha zachová slova a příslušné skóre z lexikonu.

Pak musíš výsledky sloučit do jednoho datového rámce pomocí bind_rows() a vytvořit graf s ggplot2.

Z grafu snadno poznáš, která kniha používá více pozitivního a která více negativního jazyka. Překryv je pochopitelný – Dorotce se přece jen ledacos nepěkného přihodí – ale graf hustoty naznačuje, že v Čaroději ze země Oz je pravděpodobnost pozitivního jazyka vyšší než v Agamemnonovi.

Proměnné ag a oz jsou již načtené jako tidy verze Agamemnona a Čaroděje ze země Oz, a afinn je připravená jako podmnožina lexikonu "afinn" z balíčku tidytext.

Toto cvičení je součástí kurzu

Sentiment Analysis in R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

ag_afinn <- ag %>% 
  # Inner join to afinn lexicon
  ___(___, by = c("term" = "word"))

oz_afinn <- oz %>% 
  # Inner join to afinn lexicon
  ___ 

# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")
Upravit a spustit kód