Pobieranie leksykonów sentymentu
Do tej pory korzystałeś z jednego leksykonu. Teraz przejdziemy do trzech – każdy z nich mierzy sentyment w inny sposób.
Pakiet tidytext zawiera funkcję get_sentiments, która wraz z pakietem [textdata] pozwala pobierać i wygodnie wykorzystywać dobrze zbadane leksykony. Poniżej znajduje się fragment leksykonu loughran.
| Słowo | Sentyment |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
Ten leksykon zawiera 4150 terminów wraz z odpowiadającymi im informacjami. Przyjrzymy się też innym leksykonom – ich struktura i sposób pobierania są podobne.
Wykorzystajmy tidytext i textdata, żeby zbadać etykiety słów w innych leksykonach!
To ćwiczenie jest częścią kursu
Analiza sentymentu w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)