トピックの可視化
これまでの章で学んだことを使って、LDA が生成したトピックを可視化してみましょう。
この演習はコースの一部です
Rで始めるテキスト分析
演習の手順
- トピックごとに単語確率の高い上位10件を残します。
- 単語確率で
termを並べ替える因子term2を作成します。 term2と単語確率をプロットします。- 棒グラフをトピックごと(つまり
~)にファセット化します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
word_probs <- lda_topics %>%
# Keep the top 10 highest word probabilities by topic
___(___) %>%
___(___) %>%
___() %>%
# Create term2, a factor ordered by word probability
___(term2 = ___(___))
# Plot term2 and the word probabilities
___(___) +
geom_col() +
# Facet the bar plot by topic
___(___, scales = "free") +
coord_flip()