Wizualizacja tematów
Wykorzystując to, co poznaliśmy w poprzednich rozdziałach, zwizualizujmy teraz tematy wygenerowane przez model LDA.
To ćwiczenie jest częścią kursu
Wprowadzenie do analizy tekstu w R
Instrukcje do ćwiczenia
- Zachowaj 10 słów o najwyższym prawdopodobieństwie dla każdego tematu.
- Utwórz
term2– czynnik porządkującytermwedług prawdopodobieństwa słowa. - Wykreśl
term2oraz prawdopodobieństwa słów. - Podziel wykres słupkowy według (tj.
~) tematu.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
word_probs <- lda_topics %>%
# Keep the top 10 highest word probabilities by topic
___(___) %>%
___(___) %>%
___() %>%
# Create term2, a factor ordered by word probability
___(term2 = ___(___))
# Plot term2 and the word probabilities
___(___) +
geom_col() +
# Facet the bar plot by topic
___(___, scales = "free") +
coord_flip()