Preprocesarea textului
Pentru a construi un sistem de recomandare sau orice alt model, textul trebuie mai întâi preprocesат.
Aici este încărcat un fragment de text din Sherlock Holmes. Preprocesează acest text folosind diferitele tehnici prezentate în video, pentru a-l pregăti în vederea analizei ulterioare.
Variabila text conține un extras din Câinele din Baskerville de Arthur Conan Doyle.
Următoarele pachete și funcții au fost deja importate:
nltk, torch, get_tokenizer, PorterStemmer, stopwords.
Acest exercițiu face parte din cursul
Deep Learning pentru text cu PyTorch
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Initialize and tokenize the text
tokenizer = ____("basic_english")
tokens = ____(____)
print(tokens)