文字列のクレンジング
このレッスンでは、一般的なパターンを表現できる「正規表現(regex)」の基本を学びました。ここでは次の2つの表記を扱いました。
| Expression | Does this |
|---|---|
. |
任意の1文字にマッチ |
* |
直前の要素の0回以上の繰り返しにマッチ |
たとえば、".*science " は文字列 "data science rocks!" の中の "data science " にマッチします。
前のレッスンで作成したデータセット gathered_data で、学んだことを使って response_var を変換してみましょう。
この演習はコースの一部です
tidyverse で学ぶカテゴリ型データ
演習の手順
response_var列で、str_removeを使って "rude to "(末尾のスペースも含む)より前とそれを含む部分をすべて取り除きます。response_var列からstr_removeを使って "on a plane" を取り除きます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
gathered_data %>%
# Remove everything before and including "rude to " (with that space at the end!)
mutate(response_var = ___(response_var, ___)) %>%
# Remove "on a plane"
mutate(response_var = ___(response_var, ___))