大好き!
引き続き、Twitter のセンチメント分析プロジェクトに取り組んでいます。まずは、映画やコンサートに関するポジティブなツイートを特定したいとします。
文中に含まれる単語 love、like、enjoy を見つけて、その単語をキャプチャします。さらに、別のグループで movie または concert を含むツイートに絞り込みます。あわせて映画名やコンサート名も保存します。
たとえば、I love the movie Avengers. という文があれば、love をマッチしてキャプチャします。また、movie をマッチしてキャプチャする必要があります。その後、ドット(ピリオド)までの任意の文字列をマッチしてキャプチャします。
3 つのツイート本文を含むリスト sentiment_analysis と、re モジュールはすでにセッションに読み込まれています。IPython シェルで print() を使ってデータを確認できます。
この演習はコースの一部です
Pythonで学ぶ正規表現
演習の手順
- 正規表現を完成させ、
love、like、enjoyのいずれかをキャプチャしてください。movieまたはconcertをマッチしてキャプチャしてください。.が現れるまでの任意の内容をマッチしてキャプチャしてください。 sentiment_analysisの各要素に対して、正規表現のすべてのマッチを見つけ、positive_matchesに代入してください。sentiment_analysisの各要素について、positive_matchesに含まれる結果を表示できるように、.format()メソッドを完成させてください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."
for tweet in sentiment_analysis:
# Find all matches of regex in tweet
positive_matches = re.____(____, ____)
# Complete format to print out the results
print("Positive comments found ____".format(____))