DTMの作成
tidy_twitter データを使ってドキュメント・ターム行列(DTM)を作成します。ここでは、各ツイートを1つのドキュメントとみなします。列名を確認するために、コンソールで tidy_twitter を表示してください。
この演習はコースの一部です
Rで始めるテキスト分析
演習の手順
- 整形済みのTwitterデータから始めます。
- 各ツイートで使われた各単語の出現回数を数えます。
- ツイートごとの単語数を使ってDTMを作成します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Start with the tidied Twitter data
___ %>%
# Count each word used in each tweet
___(word, ___) %>%
# Use the word counts by tweet to create a DTM
cast_dtm(___, word, n)