ПочатиПочніть безкоштовно

Конвеєр попередньої обробки «шебспірівської» мови

У PyBooks команда хоче перетворити великий набір текстових даних Шекспіра для подальшого аналізу. Найефективніше це зробити за допомогою конвеєра обробки тексту, починаючи з кроків попередньої обробки.

Для вас уже імпортовано: torch, nltk, stopwords, PorterStemmer, get_tokenizer.

Текстові дані Шекспіра збережено у змінній shakespeare, а речення вже виділено.

Ця вправа є частиною курсу

Глибоке навчання для тексту з PyTorch

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Create a list of stopwords
stop_words = set(____(____))
Редагувати та запускати код