LDA を当てはめる
最初のトピックモデルを実行してみましょう。すでに説明したとおり、LDA() 関数の3つの追加引数は、トピックモデルを正しく実行するうえで重要です。LDA() の実行には約10秒かかる場合があります。tidyverse と tidytext パッケージ、そして tidy_twitter データセットは読み込まれています。
この演習はコースの一部です
Rで始めるテキスト分析
演習の手順
topicmodelsパッケージを読み込みます。- ツイートごとの単語数をDTMにキャストします。
- トピック数2、サンプラーにGibbsを用いてLDAを実行します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Load the topicmodels package
___
# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>%
___(___) %>%
___(___)
# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
___,
k = ___,
method = ___,
control = list(seed = 42)
)