始める無料で始める

製品別のカウントと並べ替え

tidy_twitter はすでにトークン化され、カスタムのストップワードを含むストップワードが除去されています。クレームかどうかによって語の出現数の違いを可視化したいとします。

この演習はコースの一部です

Rで始めるテキスト分析

コースを見る

演習の手順

  • クレームかどうかで語をカウントします。
  • クレームかどうかごとに上位20語のみを残します。
  • 語を因子としてカウントで並べ替える前に、グループ化を解除します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

word_counts <- tidy_twitter %>%
  # Count words by whether or not its a complaint
  ___(___, ___) %>%
  # Group by whether or not its a complaint
  group_by(___) %>%
  # Keep the top 20 words
  ___(___, ___) %>%
  # Ungroup before reordering word as a factor by the count
  ___() %>%
  ___(word2 = ___(___, ___))
コードを編集して実行