製品別のカウントと並べ替え
tidy_twitter はすでにトークン化され、カスタムのストップワードを含むストップワードが除去されています。クレームかどうかによって語の出現数の違いを可視化したいとします。
この演習はコースの一部です
Rで始めるテキスト分析
演習の手順
- クレームかどうかで語をカウントします。
- クレームかどうかごとに上位20語のみを残します。
- 語を因子としてカウントで並べ替える前に、グループ化を解除します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
word_counts <- tidy_twitter %>%
# Count words by whether or not its a complaint
___(___, ___) %>%
# Group by whether or not its a complaint
group_by(___) %>%
# Keep the top 20 words
___(___, ___) %>%
# Ungroup before reordering word as a factor by the count
___() %>%
___(word2 = ___(___, ___))