トークン化とカウント
twitter_data に含まれる航空会社のツイートを、単語数の集計で探索してみましょう。各ツイートの本文は tweet_text 列にあります。
この演習はコースの一部です
Rで始めるテキスト分析
演習の手順
- tidyverse と tidytext パッケージを読み込みます。
tweet_text列のツイートをトークン化します。- トークン化したテキストで単語数を集計します。
- 集計結果を降順に並べ替えます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Load the tidyverse and tidytext packages
___(___)
___(___)
tidy_twitter <- twitter_data %>%
# Tokenize the twitter data
___(word, ___)
tidy_twitter %>%
# Compute word counts
___(___) %>%
# Arrange the counts in descending order
___(___)