始める無料で始める

トピックの可視化

これまでの章で学んだことを使って、LDA が生成したトピックを可視化してみましょう。

この演習はコースの一部です

Rで始めるテキスト分析

コースを見る

演習の手順

  • トピックごとに単語確率の高い上位10件を残します。
  • 単語確率で term を並べ替える因子 term2 を作成します。
  • term2 と単語確率をプロットします。
  • 棒グラフをトピックごと(つまり ~)にファセット化します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

word_probs <- lda_topics %>%
  # Keep the top 10 highest word probabilities by topic
  ___(___) %>% 
  ___(___) %>% 
  ___() %>%
  # Create term2, a factor ordered by word probability
  ___(term2 = ___(___))

# Plot term2 and the word probabilities
___(___) +
  geom_col() +
  # Facet the bar plot by topic
  ___(___, scales = "free") +
  coord_flip()
コードを編集して実行