CommencezCommencez gratuitement

Visualiser les sujets

En vous appuyant sur ce que nous avons vu dans les chapitres précédents, visualisons les sujets produits par le LDA.

Cette activité fait partie du cours

Introduction à l'analyse de texte en R

Voir le cours

Instructions de l’exercice

  • Conservez, par sujet, les 10 probabilités de mots les plus élevées.
  • Créez term2, un facteur qui ordonne term selon la probabilité des mots.
  • Tracez term2 et les probabilités des mots.
  • Faites des facettes du diagramme à bandes par sujet (c.-à-d., ~).

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

word_probs <- lda_topics %>%
  # Keep the top 10 highest word probabilities by topic
  ___(___) %>% 
  ___(___) %>% 
  ___() %>%
  # Create term2, a factor ordered by word probability
  ___(term2 = ___(___))

# Plot term2 and the word probabilities
___(___) +
  geom_col() +
  # Facet the bar plot by topic
  ___(___, scales = "free") +
  coord_flip()
Modifier et exécuter le code