カスタムストップワードの除去
テキストコーパス内のよく使われる用語は、棒グラフやワードクラウドで可視化できます。
ただし、可視化ツールを使う前に、まずコーパスに含まれるカスタムストップワードを除去することが重要です。
この演習では、用語頻度を確認し、"telemedicine" 用に作成したテキストコーパスからカスタムストップワードを取り除きます。
テキストコーパスは twt_corpus としてあらかじめ読み込まれています。
この演習では、qdap と tm のライブラリが読み込まれています。
この演習はコースの一部です
Rで学ぶソーシャルメディアデータ分析
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Extract term frequencies for top 60 words and view output
termfreq <- ___(twt_corpus, ___)
termfreq