始める無料で始める

LDA を当てはめる

最初のトピックモデルを実行してみましょう。すでに説明したとおり、LDA() 関数の3つの追加引数は、トピックモデルを正しく実行するうえで重要です。LDA() の実行には約10秒かかる場合があります。tidyversetidytext パッケージ、そして tidy_twitter データセットは読み込まれています。

この演習はコースの一部です

Rで始めるテキスト分析

コースを見る

演習の手順

  • topicmodels パッケージを読み込みます。
  • ツイートごとの単語数をDTMにキャストします。
  • トピック数2、サンプラーにGibbsを用いてLDAを実行します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Load the topicmodels package
___

# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>% 
  ___(___) %>% 
  ___(___)

# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
  ___,
  k = ___,
  method = ___,
  control = list(seed = 42)
)
コードを編集して実行