Greedy matching
次に、ツイート本文の中にまだ数字が含まれていることに気づきました。そこで、それらをすべて見つけることにします。
たとえば、文 I was born on April 24th に含まれる数字を抽出したいとします。欲張らない(lazy)量指定子を使うと、必要最小限の文字に一致するため、正規表現は 2 と 4 を返します。一方、貪欲(greedy)な量指定子を使うと、できるだけ多く一致させようとするため、全体の 24 を返します。
re モジュールと変数 sentiment_analysis はすでにセッションに読み込まれています。IPython Shell で print(sentiment_analysis) を実行して中身を確認できます。
この演習はコースの一部です
Pythonで学ぶ正規表現
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Write a lazy regex expression
numbers_found_lazy = re.____(r"____", ____)
# Print out the result
print(numbers_found_lazy)