ÎncepețiÎncepe gratuit

Preprocesarea textului

Pentru a construi un sistem de recomandare sau orice alt model, textul trebuie mai întâi preprocesат.

Aici este încărcat un fragment de text din Sherlock Holmes. Preprocesează acest text folosind diferitele tehnici prezentate în video, pentru a-l pregăti în vederea analizei ulterioare.

Variabila text conține un extras din Câinele din Baskerville de Arthur Conan Doyle.

Următoarele pachete și funcții au fost deja importate: nltk, torch, get_tokenizer, PorterStemmer, stopwords.

Acest exercițiu face parte din cursul

Deep Learning pentru text cu PyTorch

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Initialize and tokenize the text
tokenizer = ____("basic_english")
tokens = ____(____)
print(tokens)
Editează și rulează codul