ÎncepețiÎncepe gratuit

Pipeline de preprocesare a limbajului shakespearian

Echipa de la PyBooks dorește să transforme o bibliotecă vastă de texte shakespeariene pentru analiză ulterioară. Cea mai eficientă modalitate de a face acest lucru este printr-un pipeline de procesare a textului, începând cu etapele de preprocesare.

Următoarele au fost deja încărcate pentru tine: torch, nltk, stopwords, PorterStemmer, get_tokenizer.

Datele text shakespeariene sunt salvate în variabila shakespeare, iar propozițiile au fost deja extrase.

Acest exercițiu face parte din cursul

Deep Learning pentru text cu PyTorch

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create a list of stopwords
stop_words = set(____(____))
Editează și rulează codul