Rularea unui pipeline spaCy
Ai rulat deja un pipeline NLP spaCy pe un singur text și ai extras tokenii dintr-o listă de containere Doc. În acest exercițiu, vei exersa pașii inițiali ai rulării unui pipeline spaCy pe texts, care este o listă de șiruri de text.
Vei folosi modelul en_core_web_sm în acest scop. Pachetul spaCy a fost deja importat pentru tine.
Acest exercițiu face parte din cursul
Procesarea limbajului natural cu spaCy
Instrucțiuni pentru exercițiu
- Încarcă modelul
en_core_web_smcanlp. - Rulează modelul
nlp()pe fiecare element dintextsși adaugă fiecare containerDoccorespunzător într-o listădocuments. - Afișează textele tokenilor pentru fiecare container
Docdin listadocuments.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load en_core_web_sm model as nlp
nlp = spacy.____(____)
# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
documents.append(____)
# Print the token texts for each Doc container
for doc in documents:
print([____ for ____ in ____])