Graf hustoty jádra
Teď, když víš, co je graf hustoty jádra, si ho můžeš vytvořit! Připomeň si, že jde o vyhlazený histogram, který není ovlivněn šířkou sloupce. V tomto cvičení si z hodnot sentimentu sestavíš vlastní graf hustoty jádra.
Budeš zobrazovat 2 křivky hustoty – jednu pro Agamemnona a druhou pro Čaroděje ze země Oz. U obou provedeš inner_join() s lexikonem "afinn". Vzpomeň si, že lexikon "afinn" hodnotí výrazy na škále od -5 do 5. Po převedení do tidy formátu si každá kniha zachová slova a příslušné skóre z lexikonu.
Pak musíš výsledky sloučit do jednoho datového rámce pomocí bind_rows() a vytvořit graf s ggplot2.
Z grafu snadno poznáš, která kniha používá více pozitivního a která více negativního jazyka. Překryv je pochopitelný – Dorotce se přece jen ledacos nepěkného přihodí – ale graf hustoty naznačuje, že v Čaroději ze země Oz je pravděpodobnost pozitivního jazyka vyšší než v Agamemnonovi.
Proměnné ag a oz jsou již načtené jako tidy verze Agamemnona a Čaroděje ze země Oz, a afinn je připravená jako podmnožina lexikonu "afinn" z balíčku tidytext.
Toto cvičení je součástí kurzu
Sentiment Analysis in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
ag_afinn <- ag %>%
# Inner join to afinn lexicon
___(___, by = c("term" = "word"))
oz_afinn <- oz %>%
# Inner join to afinn lexicon
___
# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")