Starcie tytanów, część 2! Negatywne opinie
W obu firmach pracownicy wymieniali „kulturę" i „zdolnych ludzi", co wskazuje na pewne wspólne pozytywne aspekty środowiska pracy. Jednak wykres piramidowy pozwala dostrzec różnice w natężeniu tych pozytywnych cech.
Teraz kierujesz uwagę na negatywne opinie i tworzysz analogiczną wizualizację. Ramka danych common_words jest już dostępna w twoim środowisku. Tym razem wspólne bigramy pochodzą z negatywnych opinii pracowników.
To ćwiczenie jest częścią kursu
Eksploracja tekstu metodą Bag-of-Words w R
Instrukcje do ćwiczenia
- Używając
slice_max()nacommon_words, pobierz 5 najczęstszych bigramów według kolumnydiff. Wyniki nowego obiektu zostaną wyświetlone w konsoli. - Utwórz wykres
pyramid.plot(). Przekażtop5_df$AmazonNeg,top5_df$GoogleNegorazlabels = top5_df$terms. Aby poprawić etykiety, ustaw:gapna12.top.labelsnac("Amzn", "Neg Words", "Goog")
Argumenty main i unit są już ustawione.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Extract top 5 common bigrams
(top5_df <- ___ %>% ___(___, n = ___))
# Create a pyramid plot
___(
# Amazon on the left
top5_df$___,
# Google on the right
top5_df$___,
# Use terms for labels
labels = top5_df$___,
# Set the gap to 12
___ = ___,
# Set top.labels to "Amzn", "Neg Words" & "Goog"
___ = ___,
main = "Words in Common",
unit = NULL
)