GoTのステムとレンマ
この演習では、George R.R. Martin の Game of Thrones からいくつかの文が与えられます。与えられた GoT 文字列からステムとレンマを作成するのがあなたのタスクです。
ステミングは単語を語幹にまで縮約し、レンマ化は実在する語形を返す点を思い出してください。ただし、処理速度は大きく異なり、一般にステミングのほうがはるかに速いです。ステップ2と3では、それぞれの処理にかかる合計時間に注目してください。ステミングとレンマ化に要する時間を測るために、time.time() メソッドを使います。
この演習はコースの一部です
Pythonで学ぶSentiment Analysis
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Import the required packages from nltk
from nltk.stem import ____, ____
from nltk import word_tokenize
porter = PorterStemmer()
WNlemmatizer = WordNetLemmatizer()
# Tokenize the GoT string
tokens = ____(GoT)