始める無料で始める

トークン化とカウント

twitter_data に含まれる航空会社のツイートを、単語数の集計で探索してみましょう。各ツイートの本文は tweet_text 列にあります。

この演習はコースの一部です

Rで始めるテキスト分析

コースを見る

演習の手順

  • tidyverse と tidytext パッケージを読み込みます。
  • tweet_text 列のツイートをトークン化します。
  • トークン化したテキストで単語数を集計します。
  • 集計結果を降順に並べ替えます。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Load the tidyverse and tidytext packages
___(___)
___(___)

tidy_twitter <- twitter_data %>% 
  # Tokenize the twitter data
  ___(word, ___) 

tidy_twitter %>% 
  # Compute word counts
  ___(___) %>% 
  # Arrange the counts in descending order
  ___(___)
コードを編集して実行