Конвеєр попередньої обробки «шебспірівської» мови
У PyBooks команда хоче перетворити великий набір текстових даних Шекспіра для подальшого аналізу. Найефективніше це зробити за допомогою конвеєра обробки тексту, починаючи з кроків попередньої обробки.
Для вас уже імпортовано:
torch, nltk, stopwords, PorterStemmer, get_tokenizer.
Текстові дані Шекспіра збережено у змінній shakespeare, а речення вже виділено.
Ця вправа є частиною курсу
Глибоке навчання для тексту з PyTorch
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Create a list of stopwords
stop_words = set(____(____))