始める無料で始める

カスタムストップワードの除去

テキストコーパス内のよく使われる用語は、棒グラフやワードクラウドで可視化できます。

ただし、可視化ツールを使う前に、まずコーパスに含まれるカスタムストップワードを除去することが重要です。

この演習では、用語頻度を確認し、"telemedicine" 用に作成したテキストコーパスからカスタムストップワードを取り除きます。

テキストコーパスは twt_corpus としてあらかじめ読み込まれています。

この演習では、qdaptm のライブラリが読み込まれています。

この演習はコースの一部です

Rで学ぶソーシャルメディアデータ分析

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Extract term frequencies for top 60 words and view output
termfreq  <-  ___(twt_corpus, ___)
termfreq
コードを編集して実行