Kom igångKom igång gratis

Visualisera ämnen

Med hjälp av det vi gått igenom i tidigare kapitel ska vi nu visualisera de ämnen som LDA-modellen har tagit fram.

Den här övningen är en del av kursen

Introduktion till textanalys i R

Visa kurs

Övningsinstruktioner

  • Behåll de 10 högsta ordsannolikheterna per ämne.
  • Skapa term2, en faktor som ordnar term efter ordsannolikhet.
  • Plotta term2 och ordsannolikheterna.
  • Dela upp stapeldiagrammet per (dvs. ~) ämne.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

word_probs <- lda_topics %>%
  # Keep the top 10 highest word probabilities by topic
  ___(___) %>% 
  ___(___) %>% 
  ___() %>%
  # Create term2, a factor ordered by word probability
  ___(term2 = ___(___))

# Plot term2 and the word probabilities
___(___) +
  geom_col() +
  # Facet the bar plot by topic
  ___(___, scales = "free") +
  coord_flip()
Redigera och kör kod