Pipeline de preprocesare a limbajului shakespearian
Echipa de la PyBooks dorește să transforme o bibliotecă vastă de texte shakespeariene pentru analiză ulterioară. Cea mai eficientă modalitate de a face acest lucru este printr-un pipeline de procesare a textului, începând cu etapele de preprocesare.
Următoarele au fost deja încărcate pentru tine:
torch, nltk, stopwords, PorterStemmer, get_tokenizer.
Datele text shakespeariene sunt salvate în variabila shakespeare, iar propozițiile au fost deja extrase.
Acest exercițiu face parte din cursul
Deep Learning pentru text cu PyTorch
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create a list of stopwords
stop_words = set(____(____))