Zacznij terazZacznij za darmo

Starcie tytanów, część 2! Negatywne opinie

W obu firmach pracownicy wymieniali „kulturę" i „zdolnych ludzi", co wskazuje na pewne wspólne pozytywne aspekty środowiska pracy. Jednak wykres piramidowy pozwala dostrzec różnice w natężeniu tych pozytywnych cech.

Teraz kierujesz uwagę na negatywne opinie i tworzysz analogiczną wizualizację. Ramka danych common_words jest już dostępna w twoim środowisku. Tym razem wspólne bigramy pochodzą z negatywnych opinii pracowników.

To ćwiczenie jest częścią kursu

Eksploracja tekstu metodą Bag-of-Words w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Używając slice_max() na common_words, pobierz 5 najczęstszych bigramów według kolumny diff. Wyniki nowego obiektu zostaną wyświetlone w konsoli.
  • Utwórz wykres pyramid.plot(). Przekaż top5_df$AmazonNeg, top5_df$GoogleNeg oraz labels = top5_df$terms. Aby poprawić etykiety, ustaw:
    • gap na 12.
    • top.labels na c("Amzn", "Neg Words", "Goog")

Argumenty main i unit są już ustawione.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Extract top 5 common bigrams
(top5_df <- ___ %>% ___(___, n = ___))

# Create a pyramid plot
___(
    # Amazon on the left
    top5_df$___,
    # Google on the right
    top5_df$___,
    # Use terms for labels
    labels = top5_df$___,
    # Set the gap to 12
    ___ = ___,
    # Set top.labels to "Amzn", "Neg Words" & "Goog"
    ___ = ___,
    main = "Words in Common", 
    unit = NULL
)
Edytuj i uruchom kod