始める無料で始める

大好き!

引き続き、Twitter のセンチメント分析プロジェクトに取り組んでいます。まずは、映画やコンサートに関するポジティブなツイートを特定したいとします。

文中に含まれる単語 lovelikeenjoy を見つけて、その単語をキャプチャします。さらに、別のグループで movie または concert を含むツイートに絞り込みます。あわせて映画名やコンサート名も保存します。

たとえば、I love the movie Avengers. という文があれば、love をマッチしてキャプチャします。また、movie をマッチしてキャプチャする必要があります。その後、ドット(ピリオド)までの任意の文字列をマッチしてキャプチャします。

3 つのツイート本文を含むリスト sentiment_analysis と、re モジュールはすでにセッションに読み込まれています。IPython シェルで print() を使ってデータを確認できます。

この演習はコースの一部です

Pythonで学ぶ正規表現

コースを見る

演習の手順

  • 正規表現を完成させ、lovelikeenjoy のいずれかをキャプチャしてください。movie または concert をマッチしてキャプチャしてください。. が現れるまでの任意の内容をマッチしてキャプチャしてください。
  • sentiment_analysis の各要素に対して、正規表現のすべてのマッチを見つけ、positive_matches に代入してください。
  • sentiment_analysis の各要素について、positive_matches に含まれる結果を表示できるように、.format() メソッドを完成させてください。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."

for tweet in sentiment_analysis:
	# Find all matches of regex in tweet
    positive_matches = re.____(____, ____)
    
    # Complete format to print out the results
    print("Positive comments found ____".format(____))
コードを編集して実行