Kontener Doc w spaCy
Pierwszym krokiem potoku przetwarzania tekstu w spaCy jest przekształcenie podanego ciągu tekstowego w kontener Doc, który przechowuje przetworzony tekst. W tym ćwiczeniu przećwiczysz wczytywanie modelu spaCy, tworzenie obiektu nlp(), tworzenie kontenera Doc oraz przetwarzanie dostępnego ciągu text.
Model en_core_web_sm jest już pobrany.
To ćwiczenie jest częścią kursu
Przetwarzanie języka naturalnego z użyciem spaCy
Instrukcje do ćwiczenia
- Wczytaj
en_core_web_smi utwórz obiektnlp. - Utwórz kontener
docz ciągutext. - Utwórz listę zawierającą tekst każdego tokena z kontenera
doc.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load en_core_web_sm and create an nlp object
nlp = spacy.____(____)
# Create a Doc container for the text object
doc = ____(____)
# Create a list containing the text of each token in the Doc container
print([____ for ____ in ____])