Uruchamianie potoku spaCy
Uruchamiałeś już potok NLP spaCy na pojedynczym tekście i wyodrębniałeś tokeny z listy kontenerów Doc. W tym ćwiczeniu przećwiczysz pierwsze kroki uruchamiania potoku spaCy na zmiennej texts – liście ciągów tekstowych.
Do tego celu użyjesz modelu en_core_web_sm. Biblioteka spaCy została już za ciebie zaimportowana.
To ćwiczenie jest częścią kursu
Przetwarzanie języka naturalnego z użyciem spaCy
Instrukcje do ćwiczenia
- Załaduj model
en_core_web_smjakonlp. - Uruchom model
nlp()na każdym elemencie listytextsi dodaj odpowiadający mu kontenerDocdo listydocuments. - Wypisz teksty tokenów dla każdego kontenera
Docz listydocuments.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load en_core_web_sm model as nlp
nlp = spacy.____(____)
# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
documents.append(____)
# Print the token texts for each Doc container
for doc in documents:
print([____ for ____ in ____])