周囲の単語を探す
ここでは、sentiment_analysis データセットを使って可視化の準備をします。関心があるのは、python の前後に現れる単語です。特定の単語がその直前・直後に何回出現するかを数えたいとします。
先読み(Positive lookahead) (?=) は、パターンの直後に指定した表現が続くことを確認します。後読み(Positive lookbehind) (?<=) は、指定したパターンの直後に続く一致を返します。
セッションには、1 件のツイート本文が入った変数 sentiment_analysis と、re モジュールが読み込まれています。IPython Shell で print() を使うとデータを確認できます。
この演習はコースの一部です
Pythonで学ぶ正規表現
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Positive lookahead
look_ahead = re.____(r"____(____)", ____)
# Print out
print(____)