始める無料で始める

DTMの作成

tidy_twitter データを使ってドキュメント・ターム行列(DTM)を作成します。ここでは、各ツイートを1つのドキュメントとみなします。列名を確認するために、コンソールで tidy_twitter を表示してください。

この演習はコースの一部です

Rで始めるテキスト分析

コースを見る

演習の手順

  • 整形済みのTwitterデータから始めます。
  • 各ツイートで使われた各単語の出現回数を数えます。
  • ツイートごとの単語数を使ってDTMを作成します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Start with the tidied Twitter data
___ %>% 
  # Count each word used in each tweet
  ___(word, ___) %>% 
  # Use the word counts by tweet to create a DTM
  cast_dtm(___, word, n)
コードを編集して実行