始める無料で始める

GoTのステムとレンマ

この演習では、George R.R. Martin の Game of Thrones からいくつかの文が与えられます。与えられた GoT 文字列からステムとレンマを作成するのがあなたのタスクです。

ステミングは単語を語幹にまで縮約し、レンマ化は実在する語形を返す点を思い出してください。ただし、処理速度は大きく異なり、一般にステミングのほうがはるかに速いです。ステップ2と3では、それぞれの処理にかかる合計時間に注目してください。ステミングとレンマ化に要する時間を測るために、time.time() メソッドを使います。

この演習はコースの一部です

Pythonで学ぶSentiment Analysis

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Import the required packages from nltk
from nltk.stem import ____, ____
from nltk import word_tokenize

porter = PorterStemmer()
WNlemmatizer = WordNetLemmatizer()

# Tokenize the GoT string
tokens = ____(GoT) 
コードを編集して実行